Hadoop项目结构及其主要作用

组件                                                                         功能

HDFS                                                                分布式文件系统

MapReduce                                                      分布式并行编程模型

YARN                                                                资源管理和调度器

Tez                                                                    运行在YARN之上的下一代Hadoop查询处理框架

Hive                                                                  Hadoop上的数据仓库

HBase                                                              Hadoop上的非关系型的分布式数据库

Pig                                                                    一个基于Hadoop的大规模数据分析平台,提供类似SQL的查询语言

Pig LatinSqoop                                                 用于在Hadoop与传统数据库之间进行数据传递

Oozie                                                                Hadoop上的工作流管理系统

Zookeeper                                                        提供分布式协调一致性服务

Storm                                                               流计算框架Flume一个高可用的,高可靠的,分布式的海量日志采集、聚合和传输的系统AmbariHadoop快速部署工具,支持Apache Hadoop集群的供应、管理和监控

Kafka                                                               一种高吞吐量的分布式发布订阅消息系统,可以处理消费者规模的网站中的所有动作流数据Spark类似于Hadoop MapReduce的通用并行框架

 

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值