CUDA学习笔记(4) CUDA计时函数

  精确地记录核函数运行的时间可以让我们直观地了解核函数代码的运行效率。我们需要一个可以精确测量代码运行时间的方法。一般来说,所有的电脑CPU都具有硬件计数器,可以达到微妙级的计时效果,我们可以得到核函数执行所需的时间。但是,如果我们想要知道GPU中核函数中的某几行代码的运行时间,就必须使用GPU的硬件计数器了,因为核函数完全在GPU的内部执行,CPU无法干涉。

  先简单介绍下计数器工作的原理,这和《数字电路》中的计数器是同一个东西。当计数器的输入由低电平转为高电平的瞬间,计数器的值加1;当计数器的值达到它的最大值,则从0开始计数。

这里写图片描述

  无论是CPU还是GPU的计数器都是开机后就会自动地开始计数,计数到到最大值又从0开始。我们通过求得这两个值之差,再除以计数的频率,就可以得到这两次计数操作之间经过的时间。
  需要注意的是,假如计数器的最大值为255,那么当我们第一次读取的计数为245,第二次读取的计数为006,显然计数已经被重置过了,这时我们的计数次数实际上是第一次计数值取反加上第二次计数的值。
  记第一次计数为 C1 ,第二次计数为 C2 ,计数器的最大值为 M ,计数器频率为 f ,两次计数的间隔时间为 ΔT ,伪代码:

if( C1<C2
{
   ΔT=(C2C1)/f
}
else
{
   ΔT=(M+C2C1)/f
}



  举个例子,假设我们需要求

  • 3
    点赞
  • 15
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值