中间件之消息队列入门

2022-6-23 226 6/23

基础概念

消息队列是一种中间件软件,是分布式系统中重要的组件,在很多生产环境如商品抢购等需要控制并发量的场景下都需要用到。 消息队列主要解决了应用耦合、异步处理、流量削锋等问题。当前使用较多的消息队列有RabbitMQ、RocketMQ、ActiveMQ、Kafka、ZeroMQ、MetaMq等,而部分数据库如Redis、Mysql以及phxsql也可实现消息队列的功能。

组成架构

中间件之消息队列入门

消息生产
生产者(Producer):消息队列中用于产生消息的运行实体(应用系统),一般集成于业务调用链路的上游。生产者是轻量级匿名无身份的。
消息存储
主题(Topic):消息队列中消息传输和存储的分组容器,主题内部由多个队列组成,消息的存储和水平扩展实际是通过主题内的队列实现的。
队列(MessageQueue):消息队列中消息传输和存储的实际单元容器,类比于Kafka中的分区。消息队列RocketMQ版通过流式特性的无限队列结构来存储消息,消息在队列内具备顺序性存储特征。
消息(Message):消息队列的最小传输单元。消息具备不可变性,在初始化发送和完成存储后即不可变。
消息消费
消费者分组(ConsumerGroup):消息队列中定义的独立的消费身份分组,用于统一管理底层运行的多个消费者(Consumer)。同一个消费组的多个消费者必须保持消费逻辑和配置一致,共同分担该消费组订阅的消息,实现消费能力的水平扩展。
消费者(Consumer):消息队列消费消息的运行实体(应用系统),一般集成在业务调用链路的下游。消费者必须被指定到某一个消费组中。
订阅关系(Subscription):消息队列发布订阅模型中消息过滤、重试、消费进度的规则配置。订阅关系以消费组粒度进行管理,消费组通过定义订阅关系控制指定消费组下的消费者如何实现消息过滤、消费重试及消费进度恢复等。

消息队列的使用场景


应用耦合:多应用间通过消息队列对同一消息进行处理,避免调用接口失败导致整个过程失败;
异步处理:多应用对消息队列中同一消息进行处理,应用间并发处理消息,相比串行处理,减少处理时间;
限流削峰:广泛应用于秒杀或抢购活动中,避免流量过大导致应用系统挂掉的情况;
应用耦合
表示业务需要多个应用系统间调用依赖来达成。
举例:用户使用QQ相册上传一张图片,人脸识别系统会对该图片进行人脸识别,一般的做法是,服务器接收到图片后,图片上传系统立即调用人脸识别系统,调用完成后再返回成功,如下图所示:

中间件之消息队列入门

该方法有如下缺点
1.若人脸识别系统被调失败,导致图片上传失败;
2.延迟高,需要人脸识别系统处理完成后,再返回给客户端,即使用户并不需要立即知道结果;
3.图片上传系统与人脸识别系统之间互相调用,需要做耦合;
使用消息队列

中间件之消息队列入门

客户端上传图片后,图片上传系统将图片信息如uin、批次写入消息队列,直接返回成功;而人脸识别系统则定时从消息队列中取数据,完成对新增图片的识别。此时图片上传系统并不需要关心人脸识别系统是否对这些图片信息的处理、以及何时对这些图片信息进行处理。事实上,由于用户并不需要立即知道人脸识别结果,人脸识别系统可以选择不同的调度策略,按照闲时、忙时、正常时间,对队列中的图片信息进行处理。
异步处理
业务系统需要通过消息队列提高系统响应时间、业务处理效率。
举例:用户为了使用某个应用,进行注册,系统需要发送注册邮件并验证短信。对这两个操作的处理方式有两种:串行及并行。
串行方式:新注册信息生成后,先发送注册邮件,再发送验证短信。

中间件之消息队列入门

在这种方式下,需要最终发送验证短信后再返回给客户端。
并行处理:新注册信息写入后,由发短信和发邮件并行处理。

中间件之消息队列入门

在这种方式下,发短信和发邮件 需处理完成后再返回给客户端。
假设以上三个子系统处理的时间均为50ms,且不考虑网络延迟,则总的处理时间:
串行:50+50+50=150ms
并行:50+50 = 100ms
使用消息队列

中间件之消息队列入门

数据写入消息队列后立即返回成功给客户端,则总的响应时间依赖于写入消息队列的时间,而写入消息队列的时间本身是可以很快的,基本可以忽略不计,因此总的处理时间相比串行提高了2倍,相比并行提高了一倍;
限流削峰
应用系统需要应对短时超大并发,通过消息队列缓冲。
举例:购物网站开展秒杀活动,一般由于瞬时访问量过大,服务器接收过大,会导致流量暴增,相关系统无法处理请求甚至崩溃。而加入消息队列后,系统可以从消息队列中取数据,相当于消息队列做了一次缓冲。

中间件之消息队列入门

该方法有如下优点
1.请求先入消息队列,而不是由业务处理系统直接处理,做了一次缓冲,极大地减少了业务处理系统的压力;
2.队列长度可以做限制,事实上,秒杀时,后入队列的用户无法秒杀到商品,这些请求可以直接被抛弃,返回活动已结束或商品已售完信息;
其他消息驱动的系统
多个应用系统需要互相协同处理工作,通过消息队列提高业务处理效率、系统健壮性等。
举例:用户新上传了一批照片, 人脸识别系统需要对这个用户的所有照片进行聚类,聚类完成后由对账系统重新生成用户的人脸索引(加快查询)。这三个子系统间由消息队列连接起来,前一个阶段的处理结果放入队列中,后一个阶段从队列中获取消息继续处理。

中间件之消息队列入门

该方法有如下优点
1.避免了直接调用下一个系统导致当前系统失败;
2.每个子系统对于消息的处理方式可以更为灵活,可以选择收到消息时就处理,可以选择定时处理,也可以划分时间段按不同处理速度处理;

消息队列的两种模式


消息队列包括两种模式,点对点模式(point to point, queue)和发布/订阅模式(publish/subscribe,topic)。
点对点模式

中间件之消息队列入门

消息发送者生产消息发送到queue中,然后消息接收者从queue中取出并且消费消息。消息被消费以后,queue中不再有存储,所以消息接收者不可能消费到已经被消费的消息。
点对点模式特点
1.每个消息只有一个接收者(Consumer)(即一旦被消费,消息就不再在消息队列中);
2.发送者和接收者间没有依赖性,发送者发送消息之后,不管有没有接收者在运行,都不会影响到发送者下次发送消息;
3.接收者在成功接收消息之后需向队列应答成功,以便消息队列删除当前接收的消息;
发布/订阅模式

中间件之消息队列入门

发布者将消息发送到Topic,系统将这些消息传递给多个订阅者。
发布/订阅模式特点
1.每个消息可以有多个订阅者;
2.发布者和订阅者之间有时间上的依赖性。针对某个主题(Topic)的订阅者,它必须创建一个订阅者之后,才能消费发布者的消息。

3.为了消费消息,订阅者需要提前订阅该角色主题,并保持在线运行;

常用消息队列介绍


本部分主要介绍四种常用的消息队列(RabbitMQ/ActiveMQ/RocketMQ/Kafka)的主要特性、优点、缺点。
RabbitMQ
RabbitMQ 2007年发布,是一个在AMQP(高级消息队列协议)基础上完成的,可复用的企业消息系统,是当前最主流的消息中间件之一。
主要特性

1.可靠性: 提供了多种技术可以让你在性能和可靠性之间进行权衡。这些技术包括持久性机制、投递确认、发布者证实和高可用性机制;
2.灵活的路由: 消息在到达队列前是通过交换机进行路由的。RabbitMQ为典型的路由逻辑提供了多种内置交换机类型。如果你有更复杂的路由需求,可以将这些交换机组合起来使用,你甚至可以实现自己的交换机类型,并且当做RabbitMQ的插件来使用;
3.消息集群:在相同局域网中的多个RabbitMQ服务器可以聚合在一起,作为一个独立的逻辑代理来使用;
4.队列高可用:队列可以在集群中的机器上进行镜像,以确保在硬件问题下还保证消息安全;
5.多种协议的支持:支持多种消息队列协议;
6.服务器端用Erlang语言编写,支持只要是你能想到的所有编程语言;
7.管理界面: RabbitMQ有一个易用的用户界面,使得用户可以监控和管理消息Broker的许多方面;
8.跟踪机制:如果消息异常,RabbitMQ提供消息跟踪机制,使用者可以找出发生了什么;
9.插件机制:提供了许多插件,来从多方面进行扩展,也可以编写自己的插件;
优点
1.由于erlang语言的特性,mq 性能较好,高并发;
2.健壮、稳定、易用、跨平台、支持多种语言、文档齐全;
3.有消息确认机制和持久化机制,可靠性高;
4.高度可定制的路由;
5.管理界面较丰富,在互联网公司也有较大规模的应用;
6.社区活跃度高;
缺点
1.尽管结合erlang语言本身的并发优势,性能较好,但是不利于做二次开发和维护;
2.实现了代理架构,意味着消息在发送到客户端之前可以在中央节点上排队。此特性使得RabbitMQ易于使用和部署,但是使得其运行速度较慢,因为中央节点增加了延迟,消息封装后也比较大;
3.需要学习比较复杂的接口和协议,学习和维护成本较高;

ActiveMQ
ActiveMQ是由Apache出品,ActiveMQ 是一个完全支持JMS1.1和J2EE 1.4规范的 JMS Provider实现。它非常快速,支持多种语言的客户端和协议,而且可以非常容易的嵌入到企业的应用环境中,并有许多高级功能。
主要特性
1.服从 JMS 规范:JMS 规范提供了良好的标准和保证,包括:同步或异步的消息分发,一次和仅一次的消息分发,消息接收和订阅等等。遵从 JMS 规范的好处在于,不论使用什么 JMS 实现提供者,这些基础特性都是可用的;
2.连接性:ActiveMQ 提供了广泛的连接选项,支持的协议有:HTTP/S,IP 多播,SSL,STOMP,TCP,UDP,XMPP等等。对众多协议的支持让 ActiveMQ 拥有了很好的灵活性。
3.支持的协议种类多:OpenWire、STOMP、REST、XMPP、AMQP ;
4.持久化插件和安全插件:ActiveMQ 提供了多种持久化选择。而且,ActiveMQ 的安全性也可以完全依据用户需求进行自定义鉴权和授权;
5.支持的客户端语言种类多:除了 Java 之外,还有:C/C++,.NET,Perl,PHP,Python,Ruby;
6.代理集群:多个 ActiveMQ 代理可以组成一个集群来提供服务;
7.异常简单的管理:ActiveMQ 是以开发者思维被设计的。所以,它并不需要专门的管理员,因为它提供了简单又使用的管理特性。有很多中方法可以监控 ActiveMQ 不同层面的数据,包括使用在 JConsole 或者 ActiveMQ 的Web Console 中使用 JMX,通过处理 8.JMX 的告警消息,通过使用命令行脚本,甚至可以通过监控各种类型的日志。
优点
1.跨平台(JAVA编写与平台无关有,ActiveMQ几乎可以运行在任何的JVM上)
2.可以用JDBC:可以将数据持久化到数据库。虽然使用JDBC会降低ActiveMQ的性能,但是数据库一直都是开发人员最熟悉的存储介质。将消息存到数据库,看得见摸得着。而且公司有专门的DBA去对数据库进行调优,主从分离;
3.支持JMS :支持JMS的统一接口;
4.支持自动重连;
5.有安全机制:支持基于shiro,jaas等多种安全配置机制,可以对Queue/Topic进行认证和授权。
6.监控完善:拥有完善的监控,包括Web Console,JMX,Shell命令行,Jolokia的REST API;
7.界面友善:提供的Web Console可以满足大部分情况,还有很多第三方的组件可以使用,如hawtio;
缺点
1.社区活跃度不及RabbitMQ高;
2.根据其他用户反馈,会出莫名其妙的问题,会丢失消息;
3.目前重心放到activemq6.0产品-apollo,对5.x的维护较少;
4.不适合用于上千个队列的应用场景;

RocketMQ
RocketMQ出自 阿里公司的开源产品,用 Java 语言实现,在设计时参考了 Kafka,并做出了自己的一些改进,消息可靠性上比 Kafka 更好。RocketMQ在阿里集团被广泛应用在订单,交易,充值,流计算,消息推送,日志流式处理,binglog分发等场景。
主要特性
1.是一个队列模型的消息中间件,具有高性能、高可靠、高实时、分布式特点;
2.Producer、Consumer、队列都可以分布式;
3.Producer向一些队列轮流发送消息,队列集合称为Topic,Consumer如果做广播消费,则一个consumer实例消费这个Topic对应的所有队列,如果做集群消费,则多个Consumer实例平均消费这个topic对应的队列集合;
4.能够保证严格的消息顺序;
5.提供丰富的消息拉取模式;
6.高效的订阅者水平扩展能力;
7.实时的消息订阅机制;
8.亿级消息堆积能力;
9.较少的依赖;
优点
1.单机支持 1 万以上持久化队列
2.RocketMQ 的所有消息都是持久化的,先写入系统 PAGECACHE,然后刷盘,可以保证内存与磁盘都有一份数据,
3.访问时,直接从内存读取。
4.模型简单,接口易用(JMS 的接口很多场合并不太实用);
5.性能非常好,可以大量堆积消息在broker中;
6.支持多种消费,包括集群消费、广播消费等。
7.各个环节分布式扩展设计,主从HA;
8.开发度较活跃,版本更新很快。
缺点
1.支持的客户端语言不多,目前是java及c++,其中c++不成熟;
2.RocketMQ社区关注度及成熟度也不及前两者;
3.没有web管理界面,提供了一个CLI(命令行界面)管理工具带来查询、管理和诊断各种问题;
4.没有在 mq 核心中去实现JMS等接口;

Kafka

Apache Kafka是一个分布式消息发布订阅系统。它最初由LinkedIn公司基于独特的设计实现为一个分布式的提交日志系统( a distributed commit log),,之后成为Apache项目的一部分。Kafka系统快速、可扩展并且可持久化。它的分区特性,可复制和可容错都是其不错的特性。
主要特性
1.快速持久化,可以在O(1)的系统开销下进行消息持久化;
2.高吞吐,在一台普通的服务器上既可以达到10W/s的吞吐速率;
3.完全的分布式系统,Broker、Producer、Consumer都原生自动支持分布式,自动实现负载均衡;
4.支持同步和异步复制两种HA;
5.支持数据批量发送和拉取;
6.zero-copy:减少IO操作步骤;
7.数据迁移、扩容对用户透明;
8.无需停机即可扩展机器;
9.其他特性:严格的消息顺序、丰富的消息拉取模型、高效订阅者水平扩展、实时的消息订阅、亿级的消息堆积能力、定期删除机制;
优点
1.客户端语言丰富,支持java、.net、php、ruby、python、go等多种语言;
2.性能卓越,单机写入TPS约在百万条/秒,消息大小10个字节;
3.提供完全分布式架构, 并有replica机制, 拥有较高的可用性和可靠性, 理论上支持消息无限堆积;
4.支持批量操作;
5.消费者采用Pull方式获取消息, 消息有序, 通过控制能够保证所有消息被消费且仅被消费一次;
6.有优秀的第三方Kafka Web管理界面Kafka-Manager;
7.在日志领域比较成熟,被多家公司和多个开源项目使用;
缺点
1.Kafka单机超过64个队列/分区,Load会发生明显的飙高现象,队列越多,load越高,发送消息响应时间变长
2.使用短轮询方式,实时性取决于轮询间隔时间;
3.消费失败不支持重试;
4.支持消息顺序,但是一台代理宕机后,就会产生消息乱序;
5.社区更新较慢;

各类常见消息队列对比

中间件之消息队列入门

Kafka在于分布式架构,RabbitMQ基于AMQP协议来实现,RocketMQ/思路来源于kafka,改成了主从结构,在事务性可靠性方面做了优化。广泛来说,电商、金融等对事务性要求很高的,可以考虑RabbitMQ和RocketMQ,对性能要求高的可考虑Kafka。

- THE END -

Tenkms

12月01日00:03

最后修改:2023年12月1日
0

非特殊说明,本博所有文章均为博主原创。

共有 0 条评论