大数据flume的概念原理和flume与kafka的简单对比

本文介绍了Apache Flume的基本概念和工作原理,包括Flume事件、Agent的组成部分(Source、Channel、Sink),以及Flume的内部运行机制。此外,还对比了Flume与Kafka在日志系统中的角色,指出Kafka作为分布式消息中间件更适合日志缓存,而Flume在数据采集方面具有优势,常与Kafka结合使用。
摘要由CSDN通过智能技术生成

大数据flume的概念原理和flume与kafka的简单对比

一、flume的基本概念原理:

1、Apache Flume 是一个从可以收集例如日志,事件等数据资源,并将这些数量庞大的数据从各项数据资源中集中起来存储的工具/服务,或者数集中机制。flume具有高可用,分布式,配置工具,其设计的原理也是基于将数据流,如日志数据从各种网站服务器上汇集起来存储到HDFS,HBase等集中存储器中。

Flume组成架构:
在这里插入图片描述
2、Flume的组成部分:

①、Flume事件:
事件作为Flume内部数据传输的最基本单元。它是由一个转载数据的字节数组(该数据组是从数据源接入点传入,并传输给传输器,也就是HDFS/HBase)和一个可选头部构成。

②、Flume Agent:
Flume内部有一个或者多个Agent,然而对于每一个Agent来说,它就是一共独立的守护进程(JVM),它从客户端哪儿接收收集,或者从其他的 Agent哪儿接收,然后迅速的将获取的数据传给下一个目的节点sink,或者agent.。

Agent主要由:source,channel,sink三个组件组成。

Source:
从数据发生器接收数据,并将接收的数据以Flume的event格式传递给一个或者多个通道channal,Flume提供多种数据接收的方式,比如Avro,Thrift,twit

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值