首页  >  文章  >  hadoop三大组件是什么

hadoop三大组件是什么

coldplay.xixi
coldplay.xixi原创
2021-03-24 11:04:5342933浏览

hadoop三大组件:1、HDFS,一个高可靠、高吞吐量的分布式文件系统;2、MapReduce,一个分布式的离线并行计算框架;3、Yarn,分布式资源管理框架。

hadoop三大组件是什么

本文操作环境:Windows7系统,Dell G3电脑。

hadoop三大组件:

1、HDFS

一个高可靠、高吞吐量的分布式文件系统

存储海量数据

分布式

安全性

副本数据

数据是以block的方式进行存储的,128M

比如:200M—128M 72M

2、MapReduce

一个分布式的离线并行计算框架

对海量数据的处理

分布式

思想:

分而治之

大数据集分为小的数据集

每个数据集进行逻辑业务处理(map)

合并统计数据结果(reduce)

3、Yarn

分布式资源管理框架

管理整个集群的资源(内存、CPU核数)

分配调度集群的资源

相关视频推荐:PHP编程从入门到精通

以上是hadoop三大组件是什么的详细内容。更多信息请关注PHP中文网其他相关文章!

声明:
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn