消息中间件-kafka介绍

最新推荐文章于 2024-08-20 11:46:47 发布

圣小童

最新推荐文章于 2024-08-20 11:46:47 发布

阅读量992

点赞数

分类专栏：常用架构组件文章标签：消息中间件 java

本文链接：https://blog.csdn.net/elricboa/article/details/78582554

版权

Kafka是一个分布式日志系统，支持多种客户端语言，提供高吞吐量、消息持久化和扩展性。它使用Producer和Consumer模型，通过Partition和Consumer Group实现消息的有序和负载均衡。Kafka通过Zookeeper进行集群扩展，并具备可靠性机制，如Consumer自我保存状态和Broker的Replica机制。其设计目标包括高吞吐、磁盘持久化和零拷贝技术。Producer和Consumer的负载均衡算法确保高效的消息分发。Kafka的Replica机制保证了即使在Broker故障时也能维持服务。

摘要由CSDN通过智能技术生成

背景介绍

kafka是最初由Linkedin公司开发，使用Scala语言编写，Kafka是一个分布式、分区的、多副本的、多订阅者的日志系统(分布式MQ系统)，可以用于web/nginx日志，搜索日志，监控日志，访问日志等等。

kafka目前支持多种客户端语言：java，python，c++，php等等。

总体结构：

kafka名词解释和工作方式：

Producer ：消息生产者，就是向kafka broker发消息的客户端。
Consumer ：消息消费者，向kafka broker取消息的客户端
Topic ：咋们可以理解为一个队列。
Consumer Group （CG）：若干个Consumer组成的集合。这是kafka用来实现一个topic消息的广播（发给所有的consumer）和单播（发给任意一个consumer）的手段。一个topic可以有多个CG。topic的消息会复制（不是真的复制，是概念上的）到所有的CG，但每个CG只会把消息发给该CG中的一个consumer。如果需要实现广播，只要每个consumer有一个独立的CG就可以了。要实现单播只要所有的consumer在同一个CG。用CG还可以将consumer进行自由的分组而不需要多次发送消息到不同的topic。
Broker ：一台kafka服务器就是一个broker。一个集群由多个broker组成。一个broker可以容纳多个topic。
Partition：为了实现扩展性，一个非常大的topic可以分布到多个broker（即服务器）上，一个topic可以分为多个partition，每个partition是一个有序的队列。partition中的每条消息都会被分配一个有序的id（offset）。kafka只保证按一个partition中的顺序将消息发给consumer，不保证一个topic的整体（多个partition间）的顺序。
Offset：kafka的存储文件都是按照offset.kafka来命名，用offset做名字的好处是方便查找。例如你想找位于2049的位置，只要找到2048.kafka的文件即可。当然the first offset就是00000000000.kafka