不同的线程模式,对程序的性能有很大影响。目前存在的线程模型有:传统阻塞I/O
服务模型和Reactor
模式,Reactor
模式,是高性能网络编程的必知必会模式。
根据 Reactor
的数量和处理资源池线程的数量不同,有3
种典型的实现方式:分别是单Reactor
单线程模型、单Reactor
多线程模型和主从Reactor
多线程模型。
1、传统阻塞 I/O 服务模型
模型特点:
-
采用阻塞IO模式获取输入的数据;
-
每个连接都需要独立的线程完成数据的输入,业务处理,数据返回。
工作原理:
如下图所示,黄色的框表示对象, 蓝色的框表示线程,白色的框表示方法(API
)
问题分析:
-
当并发数很大,就会创建大量的线程,占用很大系统资源;
-
连接创建后,如果当前线程暂时没有数据可读,该线程会阻塞在
read
操作,造成线程资源浪费。
针对传统阻塞 I/O 服务模型的 2 个缺点,解决方案如下图所示:
-
基于
I/O
复用模型:多个连接共用一个阻塞对象,应用程序只需要在一个阻塞对象等待,无需阻塞等待所有连接。当某个连接有新的数据可以处理时,操作系统通知应用程序,线程从阻塞状态返回,开始进行业务处理; -
基于线程池复用线程资源:不必再为每个连接创建线程,将连接完成后的业务处理任务分配给线程进行处理,一个线程可以处理多个连接的业务。
2、Reactor模式简介
Reactor
对应的叫法:
- 反应器模式
- 分发者模式(
Dispatcher
) - 通知者模式(
notifier
)
上述的I/O 复用结合线程池,就是 Reactor 模式基本设计思想,如图:
说明:
-
Reactor
模式,通过一个或多个输入同时传递给服务处理器的模式(基于事件驱动); -
服务器端程序处理传入的多个请求,并将它们同步分派到相应的处理线程, 因此
Reactor
模式也叫Dispatcher
模式; -
Reactor
模式使用IO
复用监听事件, 收到事件后,分发给某个线程(进程), 这点就是网络服务器高并发处理关键。
Reactor
模式中核心组成:
-
Reactor
:Reactor
在一个单独的线程中运行,负责监听和分发事件,分发给适当的处理程序来对I/O
事件做出反应。 它就像公司的电话接线员,它接听来自客户的电话并将线路转移到适当的联系人; -
Handlers
:处理程序执行I/O
事件要完成的实际事件,类似于客户想要与之交谈的公司中的实际官员。Reactor
通过调度适当的处理程序来响应I/O
事件,处理程序执行非阻塞操作。
具体组成由下图所示:
Reactor
模式的角色构成(Reactor
模式一共有5
种角色构成):
-
Handle
(句柄或是描述符):本质上是一种资源,由操作系统提供的;该资源表示一个个事件,比如说文件描述符,或是针对网络编程的Socket
描述符。事件既可以来自于内部,也可以来自于内部;外部事件例如客户端的连接请求,客户端的数据等;内部事件例如操作系统的定时器事件等。他本质上一个文件描述符。Handle
是事件发生的发源地。 -
Synchronous Event Demultiplexer
(同步事件分离器):它本身是一个系统的调用,用于等待事件的发生(事件可以有一个,也可以有多个)。调用方法在调用它的时候回被阻塞,一直阻塞到同步事件分离器产生事件位置。对于Linux
系统来说,同步事件指的就是常用的I/O
多路复用机制,比如说select
,poll
,epoll
等。在Java NIO
中同步事件分离器指的是Selector
;对应的阻塞方法是select()
方法; -
Event Handler
(事件处理器):它本身由多个回调方法构成,这些回调方法构成了与应用相关的 对于某个事件的反馈机制。Netty
相比于Java Nio
来说,事件处理器角色上进行了一个升级,他给我们提供了大量的回调方法,供我们在特定事件产生时,实现相应的回调方法进行相应的业务处理。 -
Concrete Event Handler
(具体事件处理器):它是事件处理器的实现。它本身实现了事件处理器所提供的各个回调方法,从而实现了特定的业务逻辑。他本质上就是我们所编写的一个个处理器的实现。 -
Initiation Dispatcher
(初始分发器):实际上Reactor
角色。本身定义了一些规范,这些规范用语控制事件的调度方式,同时又提供了应用处理器的注册,删除等设施。它本身是事件的核心所在,Initiation Dispatcher
会通过同步事件分离器来等待事件的发生 。一旦事件发生,Initiation Dispatcher
首先会分离出每个事件,然后调用事件处理器,最后调用相关的回调方法来处理这些事件。
3、 单Reactor单线程模型
工作原理示意图:
方案说明:
-
Select
是前面I/O
复用模型介绍的标准网络编程API
,可以实现应用程序通过一个阻塞对象监听多路连接请求; -
Reactor
对象通过Select
监控客户端请求事件,收到事件后通过Dispatch
进行分发; -
如果是建立连接请求事件,则由
Acceptor
通过Accept
处理连接请求,然后创建一个Handler
对象处理连接完成后的后续业务处理; -
如果不是建立连接事件,则
Reactor
会分发调用连接对应的Handler
来响应 -
Handler
会完成Read
→业务处理→Send
的完整业务流程
结合实例:服务器端用一个线程通过多路复用搞定所有的IO
操作(包括连接,读、写等),编码简单,清晰明了,但是如果客户端连接数量较多,将无法支撑,前面的NIO
案例就属于这种模型。
方案优缺点分析:
(1)优点
模型简单,没有多线程、进程通信、竞争的问题,全部都在一个线程中完成。
(2)缺点
-
性能问题,只有一个线程,无法完全发挥多核
CPU
的性能。比如Handler
在处理某个连接上的业务时,整个进程就无法处理其他连接事件,很容易导致性能瓶颈; -
可靠性问题,线程意外终止,或者进入死循环,会导致整个系统通信模块不可用,不能接收和处理外部消息,造成节点故障。
**使用场景:**客户端的数量有限,业务处理非常快速,比如 Redis
在业务处理的时间复杂度 O(1)
的情况
5、 单Reactor多线程模型
工作原理示意图:
方案分析:
-
Reactor
对象通过select
监控客户端请求事件, 收到事件后,通过dispatch
进行分发; -
如果建立连接请求, 则有
Acceptor
通过accept
处理连接请求, 然后创建一个Handler
对象处理完成连接后的各种事件; -
如果不是连接请求,则由
Reactor
分发调用连接对应的handler
来处理; -
handler
只负责响应事件,不做具体的业务处理, 通过read
读取数据后,会分发给后面的worker
线程池的某个线程处理业务; -
worker
线程池会分配独立线程完成真正的业务,并将结果返回给handler
; -
handler
收到响应后,通过send
将结果返回给client
。
方案优缺点分析:
1)优点:可以充分的利用多核cpu
的处理能力。
2)缺点:多线程数据共享和访问比较复杂,Reactor
处理所有的事件的监听和响应,在单线程运行, 在高并发场景容易出现性能瓶颈。
6、主从Reactor多线程模型
针对单 Reactor
多线程模型中,Reactor
在单线程中运行,高并发场景下容易成为性能瓶颈,可以让 Reactor
在多线程中运行。
工作原理示意图:
方案说明:
-
Reactor
主线程MainReactor
对象通过select
监听连接事件, 收到事件后,通过Acceptor
处理连接事件; -
当
Acceptor
处理连接事件后,MainReactor
将连接分配给SubReactor
; -
subreactor
将连接加入到连接队列进行监听,并创建handler
进行各种事件处理; -
当有新事件发生时,
subreactor
就会调用对应的handler
处理; -
handler
通过read
读取数据,分发给后面的worker
线程处理; -
worker
线程池分配独立的worker
线程进行业务处理,并返回结果; -
handler
收到响应的结果后,再通过send
将结果返回给client
; -
Reactor
主线程可以对应多个Reactor
子线程, 即MainRecator
可以关联多个SubReactor
方案优缺点说明:
(1)优点
-
父线程与子线程的数据交互简单职责明确,父线程只需要接收新连接,子线程完成后续的业务处理。
-
父线程与子线程的数据交互简单,Reactor 主线程只需要把新连接传给子线程,子线程无需返回数据。
(2)缺点
编程复杂度较高
结合实例:
这种模型在许多项目中广泛使用,包括Nginx
主从Reactor
多进程模型,Memcached
主从多线程,Netty
主从多线程模型的支持。
7、Reactor编程的优点和缺点
优点:
-
响应快,不必为单个同步时间所阻塞,虽然
Reactor
本身依然是同步的; -
可以最大程度的避免复杂的多线程及同步问题,并且避免了多线程/进程的切换开销;
-
扩展性好,可以方便的通过增加
Reactor
实例个数来充分利用CPU
资源; -
复用性好,
Reactor
模型本身与具体事件处理逻辑无关,具有很高的复用性。
缺点:
-
相比传统的简单模型,
Reactor
增加了一定的复杂性,因而有一定的门槛,并且不易于调试; -
Reactor
模式需要底层的Synchronous Event Demultiplexer
支持,比如操作系统的select
系统调用支持,如果要自己实现Synchronous Event Demultiplexer
可能不会有那么高效; -
Reactor
模式在IO
读写数据时还是在同一个线程中实现的,即使使用多个Reactor
机制的情况下,那些共享一个Reactor
的Channel
如果出现一个长时间的数据读写,会影响这个Reactor
中其他Channel
的相应时间,比如在大文件传输时,IO
操作就会影响其他Client
的相应时间,因而对这种操作,则不合适使用Reactor
模式。