Spark、Strom、Flink和Beam的技术选型

Spark streaming、Storm、Flink和Beam都是开源的分布式系统,具有低延迟、可扩展和容错性诸多优点,允许你在运行数据流代码时,将任务分配到一系列具有容错能力的计算机上并行运行,都提供了简单的API来简化底层实现的复杂程度。

Storm

Storm中的核心抽象是“stream”。流是无限制的元组序列。Storm提供了用于以分布式且可靠的方式将流转换为新流的原语。例如,可以将推文流转换为趋势主题流。

Storm为进行流转换提供的基本原语是“spouts”和“bolts”。spouts和bolts具有您实现的接口,以运行特定于应用程序的逻辑。

spout是流的源头。例如,spout可能会从Kestrel队列中读取元组并将其作为流发出。或者,spout可能会连接到Twitter API并发出一连串推文。

bolt消耗任何数量的输入流,进行一些处理,并可能发出新的流。复杂的流转换,就像从一条推文流中计算趋势主题流一样,需要多个步骤,因此需要多个步骤。bolt可以执行任何功能,包括运行功能,过滤元组,进行流聚合,进行流联接,与数据库对话等等。

spout和bolt网络打包成一个“拓扑”,这是提交给Storm集群以执行的顶层抽象。拓扑是流转换的图形,其中每个节点都是spout和bolt。图中的边缘指示哪些bolt正在订阅哪些流。当spout或bolt向流中发送元组时,它将元组发送给订阅该流的每个bolt。

  • 1
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值