在线日志分析项目解读

最新推荐文章于 2023-12-24 15:08:53 发布

weixin_33887443

最新推荐文章于 2023-12-24 15:08:53 发布

阅读量142

点赞数

原文链接：http://blog.51cto.com/skinglzw/1967271

版权

1，日志的采集

从flume agent 上的数据一般分到两条线上一条是kafka 集群，后期可以用流式处理（spark streaming 或storm 等等）一条是到hdfs，后期可以用hive处理，

业界叫lambda架构 architecture (一般公司的推荐系统，就是用这种架构)

flume-ng agent 采集收集日志后，聚合在一个节点上（也可以不聚合）

为什么要聚合？为什么不直接写到kafka集群？

假如公司规模比较大，有无数个flume节点,这么多都连kafka，会增加复杂度，有个聚合节点（会是多个节点组成，防止单节点挂了），还可以对日志格式统一处理，筛选不要的数据

hdfs 可以永久保存数据，mr 可以处理多久数据都行

kafka 集群数据可以存储一定时间不能长期存储，sparkstreaming 只能处理一定时间访问内数据

storm 流

数据源 nginx 日志，mysql 日志，tomcat 日志等等->

flume ->

kafka 消息件消息发送到这里缓存数据一段时间 ->

spark streaming+spark sql on yarn cluster (实时计算) -> 存储

1.->redis adminLTE + flask 前端组件 + echarts3 集成到监控的系统上

2.->influxdb 时序分布式数据库 grafana 可视化组件(这两种结合比较好)

(elk kibana )

存储+可视化分析

画图工具

http://www.processon.com/

转载于:https://blog.51cto.com/skinglzw/1967271

weixin_33887443

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
在线日志分析项目解读

1，日志的采集从flume agent 上的数据一般分到两条线上一条是kafka 集群，后期可以用流式处理（spark streaming 或storm 等等）一条是到hdfs，后期可以用hive处理，业界叫lambda架构 architecture (一般公司的推荐系统，就是用这种架构)flume-ng agent 采集收集日志后，聚合在一个节点上（也可以不聚合）为什么要...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。