1.Hadoop是什么?
(1)Hadoop是一个由Apache基金会所开发的分布式系统基础架构。
(2)主要解决,海量数据的存储和海量数据的分析计算问题。
(3)广义上来说,Hadoop通常是指一个更广泛的概念——Hadoop生态圈
2.Hadoop的优势
3 Hadoop组成
4 HDFS概述
5 YARN架构概述
Yet Another Resource Negotiator 简称 YARN ,另一种资源协调者,是 Hadoop 的资源管理器。
yarn主要管理的是整个集群的内存和cpu
ApplicationManager运行在Container(容器)上,容器是一种虚拟化的技术,类似阿里云的容器虚拟技术,不会是真正的无数台服务器.
6 MapReduce架构概述
负责hadoop中的计算部分