查ICP网:全新的综合网站备案信息查询网
Copyright © 2008-2028 www.chaicp.com [ 查icp] All Rights Reserved.| 合肥寻云网络科技有限公司 | 营业执照
icp备案号:【皖B2-20160079-16】 增值电信业务经营许可证 【皖B2-20160079】 网站地图 robots文件 皖公网安备: 34010402702277号 不良举报 关于我们 免责申明 广告合作
hadoop三大组件:
1、HDFS
一个高可靠、高吞吐量的分布式文件系统
存储海量数据
分布式
安全性
副本数据
数据是以block的方式进行存储的,128M
比如:200M—128M 72M
2、MapReduce
一个分布式的离线并行计算框架
对海量数据的处理
分布式
思想:
分而治之
大数据集分为小的数据集
每个数据集进行逻辑业务处理(map)
合并统计数据结果(reduce)
3、Yarn
分布式资源管理框架
管理整个集群的资源(内存、CPU核数)
分配调度集群的资源