phpstrom查看代码总行数_如何评估多线程同步代码块大小对性能提升的影响

508ef3c0120d621cc4231a38ac6c77c2.png

前言

前面文章中我们讲过为了充分利用现代多核计算机算力来提供应用程序的执行效率,一般情况下我们会采用多线程并发执行模型来编写。其中为了设计好此类程序我们首先需要识别出应用程序的分类是计算密集型还是I/O密集型应用程序。

如果是计算密集型应用程序,由于CPU只需要读取相关的数据进行计算即可,所以不适合设计成线程数多余计算机的内核数的模型,因为如此会造成线程上下文的频繁切换而影响性能,反而是根据计算机的内核数来启动线程数反而更能够提高该类应用程序在该机器集群上执行的效率。

如果是输入/输出密集型应用程序,由于输入/输出操作过程都是由操作系统调度输入/输出控制设备来完成的,CPU只负责相关事件相应,同时又由于输入输出控制设备读取外部数据的速度远低于CPU运行的速度,所以,此类程序执行必然面对这频繁的上下文切换,而不可能让一个线程阻塞等待回复。也就是说,I/O密集型应用应该采用设计多余内核数的线程,来让所有的CPU内核不间断的执行事件相应,最好是线程池里线程数远多于CPU核数,如此可以提供CPU的利用率。

从上面的例子说明在某些情况下,为应用程序添加新资源可以提高应用程序的整体性能。

其实我们在现实的开发过程中,在某些情况下,添加某些资源并不能带来相应的应用程序性能的提升。

5167c3706c53b6161e835ec2484ebc90.png

那么是为什么呢?

我们知道在多核CPU上,多个线程可以并行执行,从而缩短执行时间,提高执行效率,但是并不是所有的应用程序都适合并行执行,而且大多数应用程序的流程都是串行和并行代码混合型的。对于需要串行执行的代码,是不可能由多个线程来同时执行的,也就是说,一个应用程序的效率提升一般都是在与能够并行执行部分决定的。

所以,为了能够计算我们的应用程序在添加更多资源时可以获得多少性能,我们需要确定程序中必须运行序列化/同步的部分,以及程序中可以并行运行的部分。

阿姆达尔定律

对于衡量一个应用程序的可并行程度方面,有一个著名的阿姆达尔定律:

它假设我们在一个可用CPU内核数为 N 的服务器上执行一个应用程序,应用程序的所有代码中只能顺序执行的代码行数所占代码总行数的比例为B,我们使用阿姆达尔定律可以估算出我们能够提高效率的上限。

如下是计算一个上限的加速我们的应用程序可以实现:

7f8dbd520d7be53192b5e1a42cb80a7a.png

如果我们让n趋于无穷,也就是说CPU核数有无限个,(1-B)/n将无限的接近于0。

因此,此时我们可以忽略这一项,如此上面的公式就无限接近于1/B,我们知道这里的B是未执行优化处理的代码中不可并行的代码行数占比。

例如,如果B是0.5,也就是或我们的应用程序的代码行数中一半不能并行化,则0.5的倒数是2。

由此我们可以看出,即使我们向应用程序添加无限数量的处理器,我们也只能获得大约2个处理器内核的加速。

假设我们可以重写代码,让应用程序运行时需要同步执行的比例变为0.25。

那么由于0.25的倒数是4,这意味着我们已经构建了一个应用程序,它运行在大量处理器内核上的速度大约是只有一个处理器内核时的4倍。

反过来,我们也可以使用阿姆达尔定律来计算程序运行时中必须同步执行以达到给定加速的部分。

如果我们想实现大约100的加速,其倒数值是0.01,这意味着我们应该只设计大约1%的代码执行同步或者串行运行。

从上面对阿姆达尔定律的应用发现,我们可以得出这样的结论:

我们的程序通过使用增加额外处理能力所能获得的最大速度提升是受到程序在同步代码部分所花费的时间的倒数值的限制。

当然,在我们实际的操作中,这个分数通常是不容易准确计算的,更不能预估我们要开发的应用程序的业务大小,但这个定律给了我们一个提示就是我们在应用程序开发过程中必须非常仔细地考虑同步,并且尽量的必须让程序的序列化运算部分足够小,以此获得更好的性能提升。

fc99dee3a7f4f167c17842bab2607f86.png

线程的性能影响

我们知道了向应用程序添加更多的线程可以提高性能和响应能力。

但另一方面,添加更多线程也是有成本的,因为线程本身总会对性能产生一些影响。

第一个影响性能的地方是线程本身的创建,这个创建过程会消耗一些时间,因为JVM必须从底层操作系统获取线程的资源,并在调度程序中准备数据结构,并将决定接下来执行哪个线程。

如果我们使用跟处理器核数相同的线程数,那么每个线程都可以在自己的处理器上运行,并且不会经常被中断。

实际上,当应用程序运行时,操作系统本身当然可能也需要处理器来处理它自己的计算。

因此,在这种情况下,线程也会被中断,并且必须等待,直到操作系统允许它们再次运行。

当我们必须使用比CPU内核更多的线程时,情况会变得更糟。因为在这种情况下,调度程序需要不断的中断线程,以便让另一个线程执行它的代码。

这种执行使得操作系统需要保存正在运行的线程的当前状态,然后恢复计划运行的线程的状态。

除此之外,调度器本身还必须对其内部数据结构执行一些更新,让这些数据结构再次使用CPU算力。

总之,这意味着从一个线程到另一个线程的每个上下文切换都会消耗CPU的算力,因此与单线程解决方案相比,过多线程将会导致性能下降。

fe52cb82ab8198621702be19f17e0683.png

并发线程共享访问

拥有多个线程的另一个代价是需要同步对共享数据结构的访问。

我们都知道在开发多线程并发访问共享资源的程序中,除了可以使用synchronized关键字之外,我们还可以使用volatile在多个线程之间共享数据。

如果多个线程竞争共享的数据,竞争就会产生。而我们的JVM就必须决定接下来执行哪个线程。

如果可以访问的线程不是当前线程的话,就会中断当前线程,引入要执行的线程,这一操作就会引入上下文切换的成本。

而当前线程就必须等待,直到它可以再次获得可以访问资源的锁。当然,JVM可以自行决定如何实现这种等待。

如果锁获取锁的预期时间很小时,采用自旋等待,也就是线程尝试一次又一次地获取锁,可能比挂起线程并让另一个线程占用CPU时所需的上下文切换更有效。

获取锁后,JVM需要将等待的线程切换会执行,这个过程需要另外一个上下文切换,这肯定会为锁争用增加额外的成本。

因此,由于存在锁的争用问题,减少必须的上下文切换次数是合理的。

总结

本文我们简单介绍了在多线程并发编程设计时对于增加线程数给应用程序性能提升上限的估算,介绍了阿姆达尔定律的使用,即我们要关注的参数是可用的CPU内核数或者集群处理器数,代码中需要同步的代码行数比例估值,可用固定一个参数去看其它参数的变化对于性能提升带来的好处。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
据来源:中经据库 主要指标110多个(全部都是纯粹的 市辖区 指标),大致是: GDP GDP增速 第一产业增加值占GDP比重 第二产业增加值占GDP比重 第三产业增加值占GDP比重 人均GDP 社会消费品零售总额 固定资产投资(不含农户) 新设外商投资企业_外商直接投资 实际利用外资金额(美元) 一般公共预算收入 一般公共预算支出 一般公共预算支出_教育 一般公共预算支出_科学技术 金融机构人民币各项存款余额_个人储蓄存款 金融机构人民币各项存款余额 金融机构人民币各项贷款余额 规模以上工业企业单位 规模以上工业企业单位_内资企业 规模以上工业企业单位_港澳台商投资企业 规模以上工业企业单位_外商投资企业 规模以上工业总产值 规模以上工业总产值_内资企业 规模以上工业总产值_港澳台商投资企业 规模以上工业总产值_外商投资企业 规模以上工业企业流动资产合计 规模以上工业企业固定资产合计 规模以上工业企业利润总额 规模以上工业企业应交增值税 规模以上工业企业主营业务税金及附加 户籍人口 年均户籍人口 户籍人口自然增长率 第一产业就业人员占全部城镇单位就业人员比重 第二产业就业人员占全部城镇单位就业人员比重 第三产业就业人员占全部城镇单位就业人员比重 城镇非私营单位就业人员 城镇非私营单位就业人员_第一产业 城镇非私营单位就业人员_第二产业 城镇非私营单位就业人员_第三产业 城镇非私营单位就业人员_农、林、牧、渔业 城镇非私营单位就业人员_采矿业 城镇非私营单位就业人员_制造业 城镇非私营单位就业人员_电力、热力、燃气及水生产和供应业 城镇非私营单位就业人员_建筑业 城镇非私营单位就业人员_批发和零售业 城镇非私营单位就业人员_交通运输、仓储和邮政业 城镇非私营单位就业人员_住宿和餐饮业 城镇非私营单位就业人员_信息传输、软件和信息技术服务业 城镇非私营单位就业人员_金融业 城镇非私营单位就业人员_房地产业 城镇非私营单位就业人员_租赁和商务服务业 城镇非私营单位就业人员_科学研究和技术服务业 城镇非私营单位就业人员_水利、环境和公共设施管理业 城镇非私营单位就业人员_居民服务、修理和其他服务业 城镇非私营单位就业人员_教育 城镇非私营单位就业人员_卫生和社会工作 城镇非私营单位就业人员_文化、体育和娱乐业 城镇非私营单位就业人员_公共管理、社会保障和社会组织 城镇非私营单位在岗职工平均人 城镇就业人员_私营企业和个体 城镇非私营单位在岗职工工资总额 城镇非私营单位在岗职工平均工资 城镇登记失业人员 建成区面积 建设用地面积 建设用地面积_居住用地 液化石油气供气总量 液化石油气供气总量_居民家庭 人工煤气、天然气供气总量 人工煤气、天然气供气总量_居民家庭 液化石油气用气人口 人工煤气、天然气用气人口 城市公共汽电车运营车辆 城市出租汽车运营车辆 城市公共汽电车客运总量 道路面积 排水管道长度 建成区绿化覆盖面积 建成区绿化覆盖率 绿地面积 公园绿地面积 维护建设资金支出 土地面积 生活用水供水量 供水总量 全社会用电量 城乡居民生活用电量 工业生产用电量 房地产开发投资 房地产开发投资_住宅 限额以上批发和零售业法人单位 限额以上批发和零售业商品销售总额 普通中学学校 中等职业教育学校 普通小学学校 普通高等学校专任教师 普通中学专任教师 中等职业教育专任教师 普通小学专任教师 普通高等学校在校生 普通中学在校生 中等职业教育在校生 普通小学在校生 电视节目综合人口覆盖率 公共图书馆总藏量_图书 医疗卫生机构_医院和卫生院 卫生人员_执业(助理)医师 医疗卫生机构床位_医院和卫生院 城镇职工基本养老保险参保人 职工基本医疗保险参保人 失业保险参保人

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值