从技术角度思考Hadoop是什么

关注 learnwithme

从技术角度思考Hadoop是什么

原创

learnwithme 2014-04-06 20:30:24 博主文章分类：学习笔记 ©著作权

文章标签 Hadoop 文章分类 Hadoop 大数据

©著作权归作者所有：来自51CTO博客作者learnwithme的原创作品，请联系作者获取转载授权，否则将追究法律责任

Hadoop 是什么？
适合海量数据的分布式存储计算平台

1.分布式

2.平台

Hadoop的生态系统

HDFS的架构（存储）

- 主从结构（相当于项目经理）：1）主节点：只有一个，NameNode；2）从结构：有很多个，DataNodes
- NameNode负责：1）接收用户操作请求 2）维护文件的目录结构 3）管理文件与block（块）之间的关系：block与DataNode之间的关系
- DataNodes负责（相当于项目工程师）：1）存储文件 2）文件被分成block存储在磁盘上 3）为保证数据安全，文件会有多个副本：廉价的服务器，发生故障的可能性高，为了提高安全性和整个系统的稳定性，采用了副本机制；例如10G的电影存储时就可能是30G

MapReduce的架构（计算）

- 主从结构：1）主节点:只有一个，JobTracker，正常情况下位于NameNode那台机上 2）从节点：有很多个，TaskTrackers
- JobTracker负责：1）接收提出的计算任务 2）把任务分给TaskTrackers执行 3)监控TaskTracker的执行情况:重新部署，透明切换
- TaskTrackers负责：执行JobTracker分配的计算任务

Hadoop的特点：1）扩展 2）成本低：普通机器即可 3）效率高：并行计算 4)可靠：副本机制，任务失败后自动地重新部署分配任务
Hadoop的集群物理分布结构

赞
收藏
评论
分享
举报

上一篇：蓝桥杯——猜字母

下一篇：用栈实现四则运算

提问和评论都可以，用心的回复会被更多人看到评论

发布评论

相关文章

举报文章

请选择举报类型

内容侵权涉嫌营销内容抄袭违法信息其他

具体原因

包含不真实信息涉及个人隐私

原文链接（必填）

补充说明

0/200

上传截图

格式支持JPEG/PNG/JPG，图片不超过1.9M

已经收到您得举报信息，我们会尽快审核

鸿蒙开发者社区

公众号矩阵

移动端

视频课免费课排行榜短视频直播课软考学堂

全部课程软考信创认证华为认证厂商认证 IT技术 PMP项目管理免费题库

在线学习

文章资源问答课堂专栏直播

51CTO

鸿蒙开发者社区

51CTO技术栈

51CTO官微

51CTO学堂

51CTO博客

CTO训练营

鸿蒙开发者社区订阅号

51CTO软考

51CTO学堂APP

51CTO学堂企业版APP

鸿蒙开发者社区视频号

51CTO软考题库

51CTO博客

首页
关注
排行榜
精品课程
免费资料
软考题库

科目全、试题精、讲解专业，扫码免费刷

搜索历史清空

热门搜索

查看【】的结果
写文章
创作中心
登录注册