HADOOP生态圈以及各组成部分的简介

Posted

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了HADOOP生态圈以及各组成部分的简介相关的知识,希望对你有一定的参考价值。

技术分享

 重点组件:

HDFS:分布式文件系统

MAPREDUCE:分布式运算程序开发框架

Hive:基于大数据技术(文件系统+运算框架)的SQL数据仓库工具

Hbase:基于Hadoop的分布式海量数据库

ZOOKEEPER:分布式协调服务基础组件

Mahout:基于mapreduce/Spark/flink等分布式运算框架的机器学习算法

Oozie:工作流调度框架

Sqoop:数据导入导出工具

Flume:日志数据采集框架


以上是关于HADOOP生态圈以及各组成部分的简介的主要内容,如果未能解决你的问题,请参考以下文章

hadoop知识体系

从零开始2016----大数据学习

一张图片看懂hadoop生态圈

贵阳如何学习大数据?大数据学习路线安排

贵阳如何学习大数据?大数据学习路线安排

大数据开发基础入门与项目实战Hadoop核心及生态圈技术栈之1.Hadoop简介及Apache Hadoop完全分布式集群搭建