2、kafka原理

目录

架构图

名词解析

工作流程

文件内部存储

数据和索引寻址


架构图

 

 

 

名词解析

  1. Producer :消息生产者,就是向 kafka broker 发消息的客户端;
  2. Consumer :消息消费者,向 kafka broker 拉取消息的客户端;
  3. Consumer Group (CG):消费者组,由多个 consumer 组成。消费者组内每个消费者负责消费不同分区的数据,一个分区只能由一个组内消费者消费;消费者组之间互不影响。所有的消费者都属于某个消费者组,即消费者组是逻辑上的一个订阅者。当分区个数和消费者组中消费者个数接近时性能最好。
  4. Broker :一台 kafka 服务器就是一个 broker。一个集群由多个 broker 组成。一个 broker 可以容纳多个 topic。
  5. Topic :可以理解为一个队列,生产者和消费者面向的都是一个 topic;也就是将kafka中的数据进行分类的作用。
  6. Partition:分区,为了实现扩展性,一个非常大的 topic 可以分布到多个 broker(即服务器)上, 一个 topic 可以分为多个 partition,每个 partition 是一个有序的队列;partition作为分区主要是用来负载均衡(生产者尽量将一个topic的内容均匀的分布在各个分区中)和提高并发(消费者可以针对分区进行并发消费)的。
  7. Replica:分区副本,为保证集群中的某个节点发生故障时,该节点上的 partition 数据不丢失,且 kafka 仍然能够继续工作,kafka 提供了副本机制,一个 topic 的每个分区都有若干个副本, 一个 leader 和若干个 follower。读取数据只会从leader中读取。副本数只能小于或者等于Broker的个数
  8. leader:每个分区多个副本的“主”,生产者发送数据的对象,以及消费者消费数据的对象都是 leader。
  9. follower:每个分区多个副本中的“从”,实时从 leader 中同步数据,保持和 leader 数据 的同步。leader 发生故障时,某个 follower 会成为新的 leader。
  10. zk中存储各个broker节点相关信息,而且broker的leader也是通过zk来选取的
  11. kafka在0.9以前,消费者消费的信息offset(消费到哪一条)也是存储在zk中,但是在0.9版本后,直接存储在kafka的系统topic中

 

 

工作流程

 

  1. Kafka 中消息是以 topic 进行分类的,生产者生产消息,消费者消费消息,都是面向 topic 的。
  2. topic 是逻辑上的概念,而 partition 是物理上的概念,在log.dirs指定目录中存着topic名+分区号的partition
  3. 每个 partition 对应于一个 log 文 件,该 log 文件中存储的就是 producer 生产的数据。Producer 生产的数据会被不断追加到该 log 文件末端,且每条数据都有自己的 offset。消费者组中的每个消费者,都会实时记录自己 消费到了哪个 offset,以便出错恢复时,从上次的位置继续消费。

 

 

文件内部存储

 

    由于生产者生产的消息会不断追加到 log 文件末尾,为防止 log 文件过大导致数据定位效率低下,Kafka 采取了分片和索引机制,将每个 partition 分为多个 segment。每个 segment 对应两个文件(“.index”文件和“.log”文件)。这些文件位于一个文件夹下,该文件夹的命名 规则为:topic 名称+分区序号

 

 

数据和索引寻址

 

    “.index”文件存储大量的索引信息,“.log”文件存储大量的数据,索引文件中的元数据指向对应数据文件中 message 的物理偏移地址。先通过二分查找法定位到索引,然后根据索引定位到数据的物理偏移量。

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

4t4run

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值