率先发现改变设备运行状态plc点位值,设备运行状态或者告警产生比较慢【延迟比较多】
分析
查看现有日志,初步分析发现消息生产到推送到Kafka有10s延迟
初步分析:
- kepserver 消息产生有时间
- emqx可以配置日志级别为 debug,查看接受到消息的时间 延迟没问题
- 发送Kafka之前的逻辑比较简单,不会有延迟
最终定位问题IOT接受消息有延迟,IOT框架内Listener监听消息有延迟 orz(初步定位,实际上是错的)
后续,又将IOT监听MQTT消息初打日志,发送Kafka消息耗时时间打印。
对比多个关键节点时间,发现两个延迟点:
- kepServer数据发生变化的时间和EMQX接收到kepServer推送的消息的时间对比:发现有个5-8s的延迟【
kepServer->EMQX
】 - Kafka发送消息到成功回调:有个固定2s左右的延迟【
Kafka
】
发现问题比解决问题更难,多打日志,好定位问题,养成习惯
最终解决
全链路排查
-
kepServer
- kepServer IOT gateway -> rate 速率设置,由10000 -> 1000
- 这个参数改为1000之后呢(kepServer延迟得到解决),原本8-10s的延迟,变为了3s延迟左右
-
kafka
- 通过代码中各个关键节点打的日志,发现Kafka发消息到成功回调基本稳定在2s延迟左右,偶尔会有基本无延迟的情况(这种情况有点意思)
- 各种查资料发现Kafka有如下几个与
消息缓存区
相关的参数
kafka: ... producer: batch-size: 16384 # kafka本地线程会去缓冲区中⼀次拉16k的数据,发送到broker buffer-memory: 33554432 # 消息缓冲区默认32m ... properties: linger: ms: 10 # 默认 10ms
如果线程拉不到16k的数据,间隔10ms也会将已拉到的数据发到broker
原本该时间参数设置的为2000ms,16k数据没拉够,只能等到2s才把数据发送到broker,因此有个2s延迟
原本这个时间参数刚好设置的就是2000ms(
kafka.producer.properties.linger.ms
),与上述刚好固定两秒延迟相符,偶尔有无延迟现象说明该消息刚发送就到了2s的频次直接就发生了无延迟该时间参数不设置或者设置小一些对延迟有明显的提升,但这样就会频繁发送消息增大网络开销,自行根据业务取舍
- 整个默认10ms吧
所有都改完之后,基本延迟在1s左右,由于链路本身就比较长,这个时间还是可以接受的。yes
最后
自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。
深知大多数Java工程师,想要提升技能,往往是自己摸索成长,自己不成体系的自学效果低效漫长且无助。
因此收集整理了一份《2024年嵌入式&物联网开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。
既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上嵌入式&物联网开发知识点,真正体系化!
如果你觉得这些内容对你有帮助,需要这份全套学习资料的朋友可以戳我获取!!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新!!
取!!**](https://bbs.csdn.net/topics/618654289)
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新!!