Jstorm最佳实践

最新推荐文章于 2024-08-07 09:51:55 发布

glowd

最新推荐文章于 2024-08-07 09:51:55 发布

阅读量985

点赞数

分类专栏： jstorm storm 文章标签： Jstorm 最佳实践

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/zengqiang1/article/details/78450895

版权

storm 同时被 2 个专栏收录

12 篇文章 0 订阅

订阅专栏

10 篇文章 0 订阅

订阅专栏

在拓扑提交过程中，不能实例化没有实现序列化接口的对象。可以通过传递参数的方式，在bolt的prepare中实例化
推荐一个worker运行2个task
减少拓扑层数，随着拓扑层数的增加，系统吞吐率下降，同时CPU利用率一直在上升，网络带宽未达到极限；
最好设置topology.max.spout.pending，这样可以避免长时间的响应，以及抖动。设置topology.max.spout.pending=5000;可以根据系统性能增减
在jstorm中， spout中nextTuple和ack/fail运行在不同的线程中，从而鼓励用户在nextTuple里面执行block的操作，原生的storm，nextTuple和ack/fail在同一个线程，不允许nextTuple/ack/fail执行任何block的操作，否则就会出现数据超时，但带来的问题是，当没有数据时，整个spout就不停的在空跑，极大的浪费了cpu，因此，jstorm更改了storm的spout设计，鼓励用户block操作（比如从队列中take消息），从而节省cpu。
在架构上，推荐 “消息中间件 + jstorm + 外部存储” 3架马车式架构
- JStorm从消息中间件中取出数据，计算出结果，存储到外部存储
- 通常消息中间件推荐使用RocketMQ，Kafka，外部存储推荐使用HBase，Mysql
- 该架构，非常方便JStorm程序进行重启（如因为增加业务升级程序）
- 职责清晰化，减少和外部系统的交互，JStorm将计算结果存储到外部存储后，用户的查询就无需访问JStorm中服务进程，查询外部存储即可。
在实际计算中，常常发现需要做数据订正，因此在设计整个项目时，需要考虑重跑功能
- 在kafka等队列中，数据最好带时间戳
- 如果计算结果入hadoop或数据库，最好结果也含有时间戳
如果使用trasaction时，增加kafka/meta时， brokerId要按顺序，即新增机器brokerId要比之前的都要大，这样reassign spout消费brokerId时就不会发生错位。
非事务环境中，尽量使用IBasicBolt
计算并发度时，spout 按单task每秒500的QPS计算并发
全内存操作的task，按单task 每秒2000个QPS计算并发
有向外部输出结果的task，按外部系统承受能力进行计算并发。
对于MetaQ 和 Kafka，拉取的频率不要太小，低于100ms时，容易造成MetaQ/Kafka 空转次数偏多，一次获取数据Block大小推荐是2M或1M，太大内存GC压力比较大，太小效率比较低。
条件允许时，尽量让程序可以报警，比如某种特殊情况出现时，比如截止到凌晨2点，数据还没有同步到hadoop，发送报警出来
从jstorm 0.9.5.1 开始，底层netty同时支持同步模式和异步模式，
- 异步模式，性能更好，但容易造成spout 出现fail，适合在无acker模式下，storm.messaging.netty.sync.mode: false
- 同步模式，底层是接收端收一条消息，才能发送一条消息，适合在有acker模式下，storm.messaging.netty.sync.mode: true

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

glowd

CSDN认证博客专家 CSDN认证企业博客

码龄15年

89: 原创

2万+: 周排名

184万+: 总排名

31万+: 访问

: 等级

3162: 积分

55: 粉丝

79: 获赞

39: 评论

394: 收藏

私信

关注

热门文章

分类专栏

最新评论

自研规则引擎
惊鸿zhang: 请问下有没有现有的规则引擎可以实现以上需求的？
区块链P2P网络协议演进过程
Doratmon: 国内第一本区块链教材<<区块链技术与应用>>把这篇文章全搬过去了，不知道有没有经过同意
以太坊基本数据结构分析
kwg126: 很详细，我想知道的都包含在里面了
规则引擎调研报告
迟到的月亮: 推荐一个新开源的规则引擎-ice 新的编排思想，轻量级，高性能，提供后台操作页面文档:http://waitmoon.com/docs

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。