java一一我爱编程

Hadoop简介

2015-03-07  本文已影响1495人  Andrew_liu

1. Hadoop简介


由于几乎所有的书中都会提到Hadoop的发展史, 这里就不说Hadoop的历史时间线了.

Hadoop是由Apache软件基金会开发的开源分布式计算平台, 通过Hadoop分布式文件系统和MapReduce为核心为用户提供分布式基础框架

Hadoop生态包括MapReduce, HDFS, ZooKeeper, Common, Avro, Chukwa, Hive, HBase等项目

2. HDFS体系结构


HDFS采用Master/Slave结构模型, 一个HDFS集群由一个NameNode(主服务器, 管理文件系统的命名空间和客户端对文件的访问操作)和若干DataNode(管理存储的数据, 处理文件系统客户端的文件读写请求)组成

3. MapReduce编程模型


MapReduce框架是由一个单独运行在主节点的JobTracker和运行在每个集群从节点的TaskTracker共同组成, 主节点负责调度构成一个作业的所有任务, 监控任务执行情况, 从节点负责处理主节点分配的任务.


整个系统:

上一篇 下一篇

猜你喜欢

热点阅读