HADOOP生态圈以及各组成部分的简介

发布时间:2020-05-31 16:50:52 作者:大数据部落
来源:网络 阅读:873

 HADOOP生态圈以及各组成部分的简介

 重点组件:

HDFS:分布式文件系统

MAPREDUCE:分布式运算程序开发框架

Hive:基于大数据技术(文件系统+运算框架)的SQL数据仓库工具

Hbase:基于Hadoop的分布式海量数据库

ZOOKEEPER:分布式协调服务基础组件

Mahout:基于mapreduce/Spark/flink等分布式运算框架的机器学习算法库

Oozie:工作流调度框架

Sqoop:数据导入导出工具

Flume:日志数据采集框架


推荐阅读:
  1. HADOOP生态圈知识概述
  2. Hadoop生态圈组件图

免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

hadoop doop had

上一篇:有了 serverless,前端也可以快速开发一个 Puppeteer 网页截图服务

下一篇:第3讲 软件测试的必要性

相关阅读

您好,登录后才能下订单哦!

密码登录
登录注册
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》