MNN推理引擎最新实测，CPU、GPU性能全面领先！

最新推荐文章于 2024-08-09 22:24:25 发布

2401_84048161

最新推荐文章于 2024-08-09 22:24:25 发布

阅读量815

点赞数 12

分类专栏：程序员文章标签： mnn 人工智能深度学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/2401_84048161/article/details/137806851

版权

MNN推理引擎在CPU和GPU性能上表现出色，尤其在ARM v8.2环境下，其在通用性、易用性和模型支持上都有显著提升。通过优化模型转换、算子实现和提供丰富的工具，如可视化支持、模型压缩和校验工具，提升了端侧AI的开发效率。尽管端侧AI整体仍处于发展初期，MNN团队致力于推动行业进步，寻求更多创新应用的可能性。

摘要由CSDN通过智能技术生成

但这再也不是当年从2000ms降低到700ms那样的飞跃了。

而如果我们放眼大一些的模型，比如Inception V3，那么情况会是：

又或是打开ARM v8.2的情况下，不论是fp16还是quant，性能都可以有一段跃迁：

你看，可以为业务带来质变优化的点依然存在。而这些，正是我们暂时按下ARM优化的原因。

通用性

除了性能，用户最为关心的指标就是通用性。性能再好，业务模型跑不起来都白搭。而MNN背靠阿里巴巴的众多智能场景，久经各方业务的磨炼，在支持算子的数量、算子实现的质量上，都可谓久经考验。但如果不是MNN的死忠粉，可能都很难意识到，我们在通用性方面下的苦功。

模型转换上，我们没有将Caffe、TensorFlow、TensorFlow Lite的转换转嫁给三方的工具，尽量避免模型格式间转换导致的失败。从开源到现在，在支持的转换算子总量上，MNN翻了一番还多。

算子实现上，我们在计算后端的支持上，应该也是业界最广的。除了前文所述的ARM v8.2，我们在GPU算子的支持上，也不遑多让。

最低0.47元/天解锁文章

关注

12
点赞
踩
6

收藏

觉得还不错? 一键收藏
0
评论
MNN推理引擎最新实测，CPU、GPU性能全面领先！

因此，相比于烈火烹油的云侧AI，或是三端一体的Flutter，我们都还需要和社区站在一起，做更进一步的探索。而MNN背靠阿里巴巴的众多智能场景，久经各方业务的磨炼，在支持算子的数量、算子实现的质量上，都可谓久经考验。而推理引擎也只是解决了模型在端侧运行的问题，从端侧AI部署的完整迭代来说，模型转换、模型压缩、开发调试、效果评估、算法和工程怎么高效协同等等，需要优化、提效的流程，还有很多。前端语言上，我们还打通了MNN和Python的桥接，方便算法工程师们，在自己熟悉的平台、熟悉的语言上，完成开发、校验。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。