大数据生态开源工具

1. Flume:日志收集软件,里面的重要概念是agent,包括 source -> channel -> slink,sourc,slink 可以为hdfs,jdbc ... 一个简单的场景是用Flume监测一个文件夹fdir的数据变化,这时fdir就是source,并将变化传送到hdfs_path上,hdfs_path就是slink。

2. Sqoop:主要用于hadoop data(hdfs/hive/hbase)和 structured database(relational database)之间的 data export/import,比如 Hive->mysql,mysql->HBase。

3. ZooKeeper:现在大多的数据存储,server都以集群的形式出现。Zookeeper就是协调集群一致性问题。还没看懂~~

4. Hive:是个数据仓库,适用于全表查询的一些操作。Hive本身不存储数据,其本身依赖于HDFS和MapReduce,其将HDFS上的结构化文件映射为一张逻辑数据表。

5. HBase:是个数据库,可以建索引。

6. Pig:数据流编程语言,提供了比MapReduce更丰富的API操作,比如join。

7. Docker:是一种开放性虚拟化容器平台,一个注册仓库服务器包含若干仓库(可以public和private),仓库用于保存镜像。一个镜像上面可以有若干个容器,一个容器包含了一个应用运行所需要的所有环境。

8. RabbitMQ:一种消息中间件,在分布式系统中用于存储转发消息,用于组件之间的解耦。组件之间用message的形式进行通信,互相不知道对方的存在。

转载于:https://www.cnblogs.com/lbingkuai/p/4566035.html

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值