kafka--概述

最新推荐文章于 2024-02-22 21:12:29 发布

缘来如此09

最新推荐文章于 2024-02-22 21:12:29 发布

阅读量122

点赞数

分类专栏： kafka

本文链接：https://blog.csdn.net/zhang09090606/article/details/115501383

版权

kafka 专栏收录该内容

7 篇文章 1 订阅

订阅专栏

一、简介

Apache kafka是消息中间件的一种,上一章已经有消息中间件的概述了，kafka主要就是Broker(消息服务器)部分提供消息核心服务

kafka，ActiveMQ,RabbitMQ是当今最流行的分布式消息中间件，其中kafka在性能及吞吐量方面是三者中的佼佼者，官方将它的定义为一个分布式流媒体平台。kafka最主要有以下几个方面作用

1.发布和订阅记录流，类似于消息队列或企业消息传递系统。

2.以容错持久的方式存储记录流。

3。处理记录发生的流

二、kafka基本术语

Topic

Kafka将消息分门别类，每一类的消息称之为一个主题（Topic）。

生产者发送消息到指定的Topic下，消息者从这个Topic下消费消息。

patition消息分区

一个Topic下面会分为很多分区，例如：“kafka-test”这个Topic下可以分为6个分区，分别由两台服务器提供，那么通常可以配置为让每台服务器提供3个分区，假如服务器ID分别为0、1，则所有的分区为0-0、0-1、0-2和1-0、1-1、1-2。Topic物理上的分组，一个 topic可以分为多个 partition，每个 partition 是一个有序的队列。partition中的每条消息都会被分配一个有序的 id（offset）。

Producer

发布消息的对象称之为主题生产者（Kafka topic producer）

Consumer

订阅消息并处理发布的消息的对象称之为主题消费者（consumers）

Broker

已发布的消息保存在一组服务器中，称之为Kafka集群。集群中的每一个服务器都是一个代理（Broker）。消费者可以订阅一个或多个主题（topic），并从Broker拉数据，从而消费这些已发布的消息。

Group消费者分组

用于归组同类消费者，在Kafka中，多个消费者可以共同消息一个Topic下的消息，每个消费者消费其中的部分消息，这些消费者就组成了一个分组，拥有同一个分组名称，通常也被称为消费者集群。

Offset偏移量

消息存储在Kafka的Broker上，消费者拉取消息数据的过程中需要知道消息在文件中的偏移量，这个偏移量就是所谓的Offset

三、kafka有四个核心API

Client和Server之间的通讯，是通过一条简单、高性能并且和开发语言无关的TCP协议。并且该协议保持与老版本的兼容。Kafka提供了Java Client（客户端）。除了Java客户端外，还有非常多的其它编程语言的客户端。

应用程序使用 Producer API 发布消息到1个或多个topic（主题）中。
应用程序使用 Consumer API 来订阅一个或多个topic，并处理产生的消息。
应用程序使用 Streams API 充当一个流处理器，从1个或多个topic消费输入流，并生产一个输出流到1个或多个输出topic，有效地将输入流转换到输出流。
Connector API 可构建或运行可重用的生产者或消费者，将topic连接到现有的应用程序或数据系统。例如，连接到关系数据库的连接器可以捕获表的每个变更。

四、主题与日志

Topic是发布的消息的类别名，一个topic可以有零个，一个或多个消费者订阅该主题的消息。对于每个topic，Kafka集群都会维护一个分区log，就像下图中所示：

partition为分区，每一个分区都是一个顺序的、不可变的消息队列，并且可以持续的添加。分区中的消息都被分了一个序列号，称之为偏移量(offset)，kafka存储的消息是k-v键值对，k是offset偏移量，v就是消息的内容，在每个分区中此偏移量都是唯一的。

Kafka集群保持所有的消息，直到它们过期（无论消息是否被消费）。实际上消费者所持有的仅有的元数据就是这个offset（偏移量），也就是说offset由消费者来控制：正常情况当消费者消费消息的时候，偏移量也线性的的增加。但是实际偏移量由消费者控制，消费者可以将偏移量重置为更早的位置，重新读取消息。可以看到这种设计对消费者来说操作自如，一个消费者的操作不会影响其它消费者对此log的处理。

缘来如此09

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
kafka--概述

一、简介Apache kafka是消息中间件的一种,上一章已经有消息中间件的概述了，kafka主要就是Broker(消息服务器)部分提供消息核心服务kafka，ActiveMQ,RabbitMQ是当今最流行的分布式消息中间件，其中kafka在性能及吞吐量方面是三者中的佼佼者，官方将它的定义为一个分布式流媒体平台。kafka最主要有以下几个方面作用 1.发布和订阅记录流，类似于消息队列或企业消息传递系统。 2.以容错持久的方式存储记录流。 3。处理记录发生的流二、kafka...
复制链接

扫一扫

专栏目录