Kafka快速实战与基本原理详解

最新推荐文章于 2022-12-28 20:06:49 发布

技术学习分享

最新推荐文章于 2022-12-28 20:06:49 发布

阅读量91

点赞数

分类专栏： Java研究分布式框架专题研究文章标签： kafka big data java

本文链接：https://blog.csdn.net/weixin_40426261/article/details/103204183

版权

Java研究同时被 2 个专栏收录

269 篇文章 1 订阅

订阅专栏

分布式框架专题研究

25 篇文章 1 订阅

订阅专栏

Kafka是最初由Linkedin公司开发，是一个分布式、支持分区的（partition）、多副本的（replica），基于zookeeper协调的分布式消息系统，它的最大的特性就是可以实时的处理大量数据以满足各种需求场景：比如基于hadoop的批处理系统、低延迟的实时系统、Storm/Spark流式处理引擎，web/nginx日志、访问日志，消息服务等等，用scala语言编写，Linkedin于2010年贡献给了Apache基金会并成为顶级开源项目。Kafka的使用场景日志收集：一个公司可以用Kafka收集各种服务的log，通过kafka以统一接口服务的方式开放给各种consumer，例如hadoop、Hbase、Solr等。消息系统：解耦和生产者和消费者、缓存消息等。用户活动跟踪：Kafka经常被用来记录web用户或者app用户的各种活动，如浏览网页、搜索、点击等活动，这些活动信息被各个服务器发布到kafka的topic中，然后订阅者通过订阅这些topic来做实时的监控分析，或者装载到hadoop、数据仓库中做离线分析和挖掘。运营指标：Kafka也经常用来记录运营监控数据。包括收集各种分布式应用的数据，生产各种操作的集中反馈，比如报警和报告

Kafka基本概念kafka是一个分布式的，分区的消息(官方称之为commitlog)服务。它提供一个消息系统应该具备的功能，但是确有着独特的设计。可以这样来说，Kafka借鉴了JMS规范的思想，但是确并没有完全遵循JMS规范。首先，让我们来看一下基础的消息(Message)相关术语

在这里插入图片描述