【MindSpore】【自定义算子开发】如何测试自定义开发算子的单算子性能?

问题描述:

我用的版本:MindSpore 1.1.1-Ascend

我开发了几个自定义算子(npu的),想要单独测一下每个算子的性能,要怎么做?

我知道可以在模型训练中用Profiler记录训练过程中的性能情况,包括算子的执行耗时;但我想自己设计一些测试用例,特定的shape的输入来测试单算子的性能。

我能想到用python的time.time()来记录算子执行前后的时间戳然后相减,但这样得出的时间应该很不准确?因为会包括编译之类的时间。

解答:

单算子性能也可以通过Profiler获得

import numpy as np
from mindspore import context, Tensor, Parameter
from mindspore.nn import Cellimport mindspore.ops as ops
from mindspore.profiler.profiling import Profiler

context.set_context(mode=context.GRAPH_MODE, device_target="Ascend")

class Net(Cell):
    def __init__(self, out_channel, kernel_size, shape1, shape2, shape3):
        super(Net, self).__init__()
        self.shape3 = shape3
        self.conv_input = ops.Conv2DBackpropInput(out_channel,
                                                  kernel_size,
                                                  pad_mode="valid",
                                                  pad=0,
                                                  mode=1,
                                                  stride=1,
                                                  dilation=1,
                                                  group=1)
        self.w = Parameter(Tensor(np.random.normal(0, 1, shape2).astype(np.float32)), name='w')
        self.out = Parameter(Tensor(np.random.normal(0, 1, shape1).astype(np.float32)), name='y')

    def construct(self):
        return self.conv_input(self.out, self.w, self.shape3)

if __name__ == "__main__":
    profiler = Profiler()
    net = Net(256, (3, 256), (64, 256, 102, 1), (256, 1, 3, 256), (64, 1, 104, 256))
    output = net()
    profiler.analyse()

可以参考这样写

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值