欢迎来到Hadoop
程序员文章站
2022-07-03 21:04:37
What Is Apache Hadoop? Hadoop是一个可靠的、可扩展的、分布式计算的开源软件。 Hadoop是一个分布式处理大数据的框架。它被设计成从一台到上千台不等的服务器,每个服务器都提供本地计算和存储的能力。它并非依赖于硬件来提供高可用服务。 Hadoop这个工程包含如下模块: Ha ......
What Is Apache Hadoop?
Hadoop是一个可靠的、可扩展的、分布式计算的开源软件。
Hadoop是一个分布式处理大数据的框架。它被设计成从一台到上千台不等的服务器,每个服务器都提供本地计算和存储的能力。它并非依赖于硬件来提供高可用服务。
Hadoop这个工程包含如下模块:
Hadoop Common:公共模块 Hadoop Distributed File System (HDFS™):分布式文件系统 Hadoop YARN:一个任务调度和集群资源管理的框架 Hadoop MapReduce:一个机遇YARN的系统,用于并行处理大数据其它相关的工程还包括:
HBase:一个弹性的、分布式的数据库,支持结构化的数据存储 Hive:一个数据仓库的基础设施,提供数据汇总和查询 Spark:一个快速、通用的计算引擎。Spark提供简单并且有表现力的程序模块以支持大范围的应用,包括ETL、机器学习、流处理和图计算 Zookeeper:为分布式应用提供一个高性能的协调服务
上一篇: 记一次数据库时间范围搜索慢的原因
下一篇: vue.js input框之间赋值方法