频域补零上采样_频域深度学习 Learning in the Frequency Domain

最新推荐文章于 2024-07-08 21:48:57 发布

atone2003

最新推荐文章于 2024-07-08 21:48:57 发布

阅读量633

点赞数

文章标签：频域补零上采样

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_31021649/article/details/112700723

版权

本文探讨了将深度学习模型从空间域转换到频域的可能性，通过频域预处理和通道选择降低计算成本，提高推理精度。论文提出的方法将图像先转换到YCbCr颜色空间，再进入频域，利用学习机制选择关键通道，减少了通信带宽需求。实验表明，低频通道和亮度分量对视觉推理任务更具信息性。

摘要由CSDN通过智能技术生成

学过信号与系统的同学应该记得，信号可以分为：时域信号（一维），空间域（多维），频域，自相关域和小波域。真实世界的信号一般是连续的模拟信号，存在于时域和空间域。

通常通过傅里叶变换从时域或者空间域转换到频域。傅里叶变换将信号信息转换成每个成分频率上的幅度和相位。在频域分析信号的最常见目的是分析信号属性。工程师通过分析频谱就可以知道输入信号中包含了哪些频率的信号。

显然一般的深度学习方法，以图像为例，模型的输入为图像本身，属于空间域信息，那么有没有可能将空间域信息转换到频域进行分析，并得到一些效果的提升或其他方面的优势呢？Learning in the Frequency Domain这篇论文告诉我们是可以的。

为什么需要频域

在传统方法中，通常在CPU上对高分辨率RGB图像进行预处理，然后将其传输到GPU / AI加速器以进行实时推断。由于RGB格式的未压缩图像通常较大，因此对CPU和GPU / AI加速器之间的通信带宽的要求通常很高。为了降低计算成本和通信带宽需求，将高分辨率RGB图像下采样为较小的图像，这通常会导致信息丢失和推理精度降低。

最低0.47元/天解锁文章

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。