线程模型的基本介绍
不同的线程模型,对程序的性能有很大的影响。目前主要存在两种线程模型:
- 传统阻塞I/O服务模型
- Reactor模式
根据Reactor的数量和处理资源池的数量不同,有3种典型的实现:
- 单Reactor单线程
- 单Reactor多线程
- 主从Reactor多线程
Netty线程模式(Netty主要基于主从Reactor多线程模型做了一定的改进,其中主从Reactor多线程模型有了多个Reactor)
传统阻塞I/O服务模型
- 采用阻塞IO模式获取输入的数据
- 每个连接都需要独立的线程完成数据的输入,业务处理,和数据返回
- 当并发数很大的时候,就会创建大量的线程,占用很大的系统资源
- 当连接创建后,如果当前线程暂时没有数据可读的时候,该线程就会阻塞read操作,造成线程资源浪费
Reactor模式
Reactor模式针对阻塞IO服务模型的2个缺点,解决方案:
1、基于I/O复用模型:多个连接共用一个阻塞对象,应用程序只需要在一个阻塞对象等待(accept),无需阻塞等待所有连接。当某个连接有新的数据可以处理的时候,操作系统通知应用程序,线程从阻塞状态返回,开始进行业务处理。
Reactor对应的叫法 1.反应器模式 2. 分发者模式Dispatcher 3.通知者模式notifier
2.基于线程池复用线程资源:不必在为每个连接创建一个线程,将连接完成后的业务处理分配给线程进行处理,一个线程可以处理多个连接的业务。
对上图的说明
- Reactor模式,通过一个或多个输入同时传递给服务器的模式
- 服务器端处理传入的多个请求,并经他们同步分派到相应的处理线程,因此Reactor模式也叫Dispatcher模式
- Reactor模式使用IO复用监听事件,收到时间之后,分发给某个线程,这点就是网络高并发处理关键
Reactor模式中的核心组成
- Reactor: 类似于Selector,再一个单独的线程中运行,负责监听和分发事件,分发给适当的处理处理程序来对IO时间做出反应。
- Handlers:用于处理程序执行的I/O事件。Reactor通过调用适当的处理陈旭来响应I/O事件,处理程序执行非阻塞操作。
单Reactor单线程
- Select可以实现应用程序通过一个阻塞对象监听多路连接请求
- Reactor对象通过Select监控客户端请求事件,收到事件后Dispatch进行分发
- 如果建立连接请求事件,则由Acceptor通过Accept处理连接请求,然后创建一个Handler对象处理连接完成后的后续业务梳理
- 如果不是建立连接时间,则Reactor会分发调用连接对应的Handler来响应
- Handler会完成Read->业务处理->Send的完成业务流程
优点:模型简单,没有多线程,进程通信的进程的问题,全部在一个线程中完成
缺点:
- 性能问题,因为只有一个线程,无法完全发挥多核CPU的性能。Handler在处理某个连接上的业务的时候,整个进程无法处理其他连接事件,很容易导致性能瓶颈
- 可靠新问题,线程意外终止,或者进入死循环,会导致整个系统通信模块不可用,不能接受和处理外部消息,造成节点故障。
使用场景:客户端数量有限,业务处理非常快速,比如Redis在业务处理的时间复杂度O(1)的情况。
单Reactor多线程
- Reactor对象通过select监控客户端请求事件,收到事件后,通过dispatch进行分发
- 如果建立连接请求之后,则Acceptor处理连接请求,然后创建一个Handler对象处理完成连接后的各种事件
- 如果不是连接请求,则由reactor分发调用连接对应的Handler来处理
- handler只负责响应时间,不做具体的业务处理,通过read读取数据之后,会分发给worker线程池的某个线程处理任务
- worker线程池会分配独立线程完成真正的业务,并将结果返回给handler
- handler收到响应后,通过send将结果返回给client
优点:可以充分利用多核cpu的处理能力
缺点:多线程数据共享和访问比较复杂,reactor处理所有的事件的监听和响应,在单线程运行,在高并发下容易出现性能瓶颈
主从Reactor多线程
- Reactor主线程MainReactor对象通过select监听连接事件。收到事件后,通过Acceptor处理连接事件
- 当Acceptor处理连接时间后,MainReactor将连接分配给SubReactor
- SubReactor将新连接假如到连接队列进行监听,并创建handler进行各种事件的处理
- 当有新事件发生的时候,subreactor就会调用对应的handler处理
- handler通过read读取数据,分发给后面的worker线程处理
- worker线程池分配独立的worker线程进行业务处理,并返回结果
- handler收到响应的结果之后,在通过send将结果返回给client
- Reactor主线程可以有多个subReactor子线程,即MainReactor可以关联多个subreactor
优点:
- 父线程与子线程的数据交互简单职责明确,父线程只需要接受线连接,子线程完成后续的业务处理
- Reactor主线程只需要把新连接传给子线程,子线程无需返回数据
缺点:编程复杂度较高
这种模型在许多项目中广泛使用,包括Nginx主从Reactor多进程模型,,Memcached 主从多线程, Netty 主从多线程模型的支持
- 单 Reactor 单线程,前台接待员和服务员是同一个人,全程为顾客服
- 单 Reactor 多线程,1 个前台接待员,多个服务员,接待员只负责接待
- 主从 Reactor 多线程,多个前台接待员,多个服务生
Reactor模式的优点
- 响应快,不必为单个同步时间所阻塞,虽然Reactor本身依然是同步的
- 可以最大程度避免复杂的多线程同步问题,并且避免了多线程、进程的切换开销
- 扩展性好,可以方便的通过增加Reactor实例个数来充分的利用CPU资源
- 复用性好,Reactor模型本身与具体时间处理逻辑无关,所以有很高的复用性。
Netty模型
Netty线程模型简单版
Netty主要基于主从Reactors多线程模型做了一定的改进,其中主从Reactor多线程模型有了多个Reactor
- BossGroup线程维护了Selector,只关注Accpet
- 当接收到Accept时间之后,回去对应的SocketChannel,封装成NIOSocketChannel并注册到Worker线程(事件循环)并进行维护
- 当Worker线程监听到Selector中通道发生自己感兴趣的时间之后,就进行处理,交友Handler,注意handler已经加入到通道。
Netty线程模型详细版
- Netty抽象出两组线程池BossGroup专门负责接收客户端的连接,Worker专门负责网络的读写
- BossGroup和WorkerGroup类型都是NIOEventLoopGroup
- NioEventLoopGroup相当与一个时间循环组,会有多个selector,这个组中含有个时间循环,每一个循环都是NioEventLoop
- NioEventLoop表示一个不断循环的执行处理任务的线程,每个NioEventLoop都有一个Selector,用于监听绑定注册在其上的socket的网络通讯
- NioEventLoopGroup可以用多个线程,即可以有多个NioEventLoop
- 每个BossNioEventLoop循环执行的步骤有3步:
轮询Accpet事件,
处理accept事件,与client建立连接,生成NioSocketChannel,并将其注册某个workerNIOEventLoop上面的selector
处理任务队列的任务即runAllTasks - 每个Worker NIOEventLoop循环执行下面几个步骤:
轮询read,write事件
处理i/o事件,即read,write事件,在对应的NioSocketChannel中处理
处理任务队列的任务 , 即 runAllTasks - 每个workerNIOEventLoop处理业务的时候,会使用pipeline,基于责任链模式,pipeline中包含了channel,即通过pipeline可以获取通道,管道中维护了很多的handler处理器