常见的消息中间件
当前使用较多的消息队列有RabbitMQ、RocketMQ、ActiveMQ、Kafka等
部分数据库如Redis、MySQL也可实现消息队列的功能
RabbitMQ
RabbitMQ于2007年发布,使用Erlang编写的一个开源的消息队列,本身支持很多的协议:AMQP,XMPP,SMTP,STOMP,也正是如此,使的它变的非常重量级,更适合于企业级的开发。同时实现了Broker架构,核心思想是生产者不会将消息直接发送给队列,消息在发送给客户端时先在中心队列排队。对路由、负载均衡、数据持久化都有很好的支持。多用于进行企业级的ESB整合
主要特点
- 可靠性:提供多种技术可以让你在性能和可靠性之间进行权衡,包括持久性机制、投递确认、发布者证实和高可用性机制
- 灵活的路由:消息在到达队列前是通过交换机进行路由的。RabbitMQ为典型的路由逻辑提供了多种内置交换机类型。如果你有更复杂的路由需求,可以将这些交换机组合起来使用,你甚至可以实现自己的交换机类型,并且当做RabbitMQ的插件来使用
- 消息集群:在相同局域网中的多个RabbitMQ服务器可以聚合在一起,作为一个独立的逻辑代理来使用
- 队列高可用:队列可以在集群中的机器上进行镜像,以确保在硬件问题下还保证消息安全
- 支持多种协议:支持多种消息队列协议
- 支持多种语言:用Erlang语言编写,支持只要是你能想到的所有编程语言
- 管理界面:RabbitMQ有一个易用的用户界面,使得用户可以监控和管理消息Broker的许多方面
- 跟踪机制:如果消息异常,RabbitMQ 提供消息跟踪机制,使用者可以找出发生了什么
- 插件机制:提供了许多插件,来从多方面进行扩展,也可以编写自己的插件
优点
- 由于Erlang语言的特性,消息队列性能较好,支持高并发
- 健壮、稳定、易用、跨平台、支持多种语言、文档齐全
- 有消息确认机制和持久化机制,可靠性高
- 高度可定制的路由
- 管理界面较丰富,在互联网公司也有较大规模的应用,社区活跃度高
缺点
- 尽管结合了Erlang 语言本身的并发优势,性能较好,但是不利于做二次开发和维护
- 实现了代理架构,意味着消息在发送到客户端之前可以在中央节点上排队,此特性使得RabbitMQ易于使用和部署,但是使得其运行速度较慢,因为中央节点增加了延迟,消息封装后也比较大,需要学习比较复杂的接口和协议,学习和维护成本较高
总结
- 在高吞吐,高可用上不如Kafka、RocketMQ
- 支持多种语言的客户端
- 由于是Erlang语言开发,性能比较好,使用RAM模式时性能很好
RocketMQ
RocketMQ出自阿里的开源产品,用Java语言实现,在设计时参考了Kafka,并做出了自己的一些改进,消息可靠性上比Kafka更好;RocketMQ在阿里内部被广泛应用在订单,交易,充值,流计算,消息推送,日志流式处理,binglog分发等场景
主要特点
- 基于 队列模型:具有高性能、高可靠、高实时、分布式等特点
- Producer、Consumer、队列都支持分布式
- Producer向队列轮流发送消息,队列集合称为Topic,Consumer如果做广播消费,则一个Consumer实例消费这个Topic对应的所有队列;如果做集群消费,则多个Consumer 实例平均消费这个Topic对应的队列集合
- 能够保证严格的消息顺序
- 提供丰富的消息拉取模式
- 高效的订阅者水平扩展能力
- 实时的消息订阅机制
- 亿级消息堆积能力
- 较少的外部依赖
优点
- 单机支持1万以上持久化队列
- RocketMQ的所有消息都是持久化的,先写入系统PAGECACHE,然后刷盘,可以保证内存与磁盘都有一份数据,而访问时,直接从内存读取
- 模型简单,接口易用(JMS的接口很多场合并不太实用)
- 性能非常好,可以允许大量堆积消息在Broker中
- 支持多种消费模式,包括集群消费、广播消费等
- 各个环节分布式扩展设计,支持主从和高可用
- 开发度较活跃,版本更新很快
缺点
- 支持的 客户端语言不多,目前是Java及C++,其中C++还不成熟
- RocketMQ社区关注度及成熟度也不及前两者
- 没有Web管理界面,提供了一个 CLI (命令行界面) 管理工具带来查询、管理和诊断各种问题
- 没有在MQ核心里实现JMS等接口
总结
- 在高吞吐,低延迟,高可用,集群热扩展,集群容错上有非常好的表现
- API,系统设计都更适合业务处理的场景
- 支持多种消费方式
- 提供消息顺序消费能力,Consumer可以水平扩展,消费能力强
ActiveMQ
ActiveMQ是由Apache出品,ActiveMQ是一个完全支持JMS1.1和J2EE 1.4规范的JMS Provider实现,它非常快速,支持多种语言的客户端和协议,而且可以非常容易的嵌入到企业的应用环境中,并有许多高级功能
主要特点
- 服从JMS规范:JMS规范提供了良好的标准和保证,包括同步或异步的消息分发,一次和仅一次的消息分发,消息接收和订阅等等;遵从JMS规范的好处在于不论使用什么JMS实现提供者,这些基础特性都是可用的
- 连接灵活性:ActiveMQ提供了广泛的连接协议,支持的协议有:HTTP/S,IP多播,SSL,TCP,UDP等等,对众多协议的支持让ActiveMQ拥有了很好的灵活性
- 支持的协议种类多:OpenWire、STOMP、REST、XMPP、AMQP
- 持久化插件和安全插件:ActiveMQ提供了多种持久化选择,而且ActiveMQ的安全性也可以完全依据用户需求进行自定义鉴权和授权
- 支持的客户端语言种类多:除了Java之外,还有:C/C++,.NET,Perl,PHP,Python,Ruby
- 代理集群:多个ActiveMQ代理可以组成一个集群来提供服务
- 异常简单的管理:ActiveMQ是以开发者思维被设计的,所以它不需要专门的管理员,因为它提供了简单又实用的管理特性;有很多方法可以监控ActiveMQ不同层面的数据,包括使用在JConsole或者在ActiveMQ的WebConsole中使用JMX,通过处理JMX的告警消息,通过使用命令行脚本,甚至可通过监控各种类型的日志
优点
- 跨平台(JAVA编写与平台无关,ActiveMQ几乎可以运行在任何的JVM上)
- 可以用JDBC:可以将数据持久化到数据库。虽然使用JDBC会降低ActiveMQ的性能,但是数据库一直都是开发人员最熟悉的存储介质
- 支持JMS规范:支持JMS规范提供的统一接口
- 支持自动重连和错误重试机制
- 有安全机制:支持基于shiro,jaas等多种安全配置机制,可以对Queue/Topic进行认证和授权
- 监控完善:拥有完善的监控,包括WebConsole,JMX,Shell命令行,Jolokia的RESTful API
- 界面友善:提供的WebConsole可以满足大部分情况,还有很多第三方的组件可以使用,比如hawtio
缺点
- 社区活跃度不及RabbitMQ高
- 根据其他用户反馈,会出莫名其妙的问题,会丢失消息
- 目前重心放到activemq6.0产品Apollo,对5.x的维护较少
- 不适合用于上千个队列的应用场景
总结
- 成熟的产品,已经在很多公司得到应用,且非常大规模的场景
- 有较多的文档
- 各种协议支持比较好,有多种语言的客户端支持
Kafka
Apache Kafka是一个分布式消息发布订阅系统,它最初由LinkedIn公司基于独特的设计实现为一个分布式的日志提交系统(a distributed commit log),之后成为Apache项目的一部分,Kafka性能高效,可扩展良好,并且可持久化,它的分区特性、可复制、可容错都是其不错的特性
主要特性
- 快速持久化:可以在O(1)的系统开销下进行消息持久化
- 高吞吐:在一台普通的服务器上既可以达到10W/s的吞吐速率
- 完全的分布式系统:Broker、Producer和Consumer都原生自动支持分布式,自动实现负载均衡
- 支持同步和异步复制两种高可用机制
- 支持数据批量发送和拉取
- 零拷贝技术(zero-copy):减少IO操作步骤,提高系统吞吐量
- 数据迁移、扩容对用户透明
- 无需停机即可扩展机器
- 其他特性:丰富的消息拉取模型、高效订阅者水平扩展、实时消息订阅、亿级消息堆积能力、定期删除机制
优点
- 客户端语言丰富:支持Java、.Net、PHP、Ruby、Python、Go等多种语言
- 高性能:单机写入TPS约在100万条/秒,消息大小10个字节
- 提供完全分布式架构,并有replica机制,拥有较高的可用性和可靠性,理论上支持消息无限堆积
- 支持批量操作
- 消费者采用Pull方式获取消息,消息有序,通过控制能够保证所有消息被消费且仅被消费一次
- 有优秀的第三方KafkaWeb管理界面,如Kafka-Manager
- 在日志领域比较成熟,被多家公司和多个开源项目使用
缺点
- Kafka单机超过64个队列/分区时,Load会发生明显的飙高现象,队列越多负载越高发送消息响应时间变长
- 使用短轮询方式,实时性取决于轮询间隔时间
- 消费失败不支持重试
- 支持消息顺序,但是一台代理宕机后,就会产生消息乱序
- 社区更新较慢
总结
- 在高吞吐,低延迟,高可用,集群热扩展,集群容错上有非常好的表现
- Producer端提供缓存、压缩功能,可提高性能和效率
- 提供顺序消费
- 生态完善,在大数据处理方面有大量配套的设施
对比分析图
AciveMQ | RocketMQ | RabbitMQ | Kafka | |
---|---|---|---|---|
定位 | 可靠消息传输 | 非日志可靠消息传输 | 可靠消息传输 | 实时数据处理、日志处理 |
成熟度 | 成熟 | 成熟 | 成熟 | 成熟 |
所属社区/公司 | Apache | Apache(Alibaba开发) | Apache | Apache |
社区活跃度 | 高 | 中 | 高 | 高 |
API完备性 | 非常高 | 高 | 高 | 高 |
MQ本身开发语言 | Java | Java | Erlang | Scala |
支持协议 | OpenWire、STOMP、REST、XMPP、AMQP | 自己定义的一套 | AMQP | 自定义的一套(基于TCP的二进制协议) |
持久化方式 | 内存、文件、数据库 | 文件 | 内存、文件 | 文件 |
客户端支持语言 | Java、C、C++、Python、PHP、Perl、C#等 | Java、C++(不成熟) | Java、C、C++、Python、PHP、Perl、C#等 | Java、C++、Python、Scala |
部署方式 | 单机、集群 | 单机、集群 | 单机、集群 | 单机、集群 |
集群管理 | 独立 | nameserver | 独立 | zookeeper |
选主方式 | 基于zk+leavelDB的master-slaver方式 | 支持多master模式,多master多slaver模式,异步复制模式 | Master提供服务,Slaver提供备份 | 支持多副本机制,leader宕机,follower自动顶上去重新选举leader |
可用性 | 高 | 非常高 | 高 | 非常高 |
消息写入性能 | 较好 | 很好 | 较好 | 非常好 |
单机队列数 | 较多 | 单机最高5万 | 依赖内存 | 单机超过64个队列或者分区会出现标高 |
事务消息 | 支持 | 支持 | 不支持 | 不支持 |
消息过滤 | 不支持 | 支持 | 不支持 | 0.11.0之后版本支持 |
消息查询 | 不支持 | 支持 | 不支持 | 不支持 |
失败重试 | 支持 | 支持 | 支持 | 不支持 |
重新消费 | 支持 | 支持 | 不支持 | 支持 |
消费方式 | Consumer pull | Consumer pull | Broker push | Consumer pull |
批量发送 | 支持 | 支持 | 不支持 | 支持 |
消息清理 | 指定文件保存时间过期删除 | 指定文件保存时间过期删除 | 可用内存少于40%触发gc | 指定文件保存时间过期删除 |
内容整理来自网络