【深度学习】模型压缩

JNingWei

已于 2023-01-25 16:51:42 修改

阅读量2.8k

点赞数 3

分类专栏：深度学习文章标签：深度学习人工智能计算机视觉神经网络 cnn

于 2018-01-31 17:03:30 首次发布

本文链接：https://blog.csdn.net/JNingWei/article/details/79218745

版权

79 篇文章 60 订阅

订阅专栏

预训练后的深度神经网络模型往往存在着严重的 过参数化 问题，其中只有约5%的参数子集是真正有用的。为此，对模型进行时间和空间上的压缩，便谓之曰 模型压缩 。

模型压缩技术包括 前端压缩 和 后端压缩 这两部分。

不会改变原始网络结构的压缩技术。

蒸馏模型采用的是 迁移学习，通过采用 预先训练好的复杂模型（Teacher model）的输出作为 监督信号 去训练另外一个简单的网络。这个简单的网络称之为student model。

“挤压”设计与 “扩张”设计。

在训练时使用稀疏约束（加入权重的稀疏正则项，引导模型的大部分权重趋向于0）。完成训练后，剪去滤波器上的这些 0 。

会大程度上改变原始网络结构的压缩技术，且不可逆。

使用结构化矩阵来进行低秩分解。

完成训练后，不加限制地剪去那些冗余参数。

优点：使模型更加成熟。
缺点：易导致网络结构随机且稀疏。由于被剪除的网络连接在分布上缺乏连续性，导致在实际使用模型时，CPU cache和内存之间会增加很多不必要的频繁切换。这种“每次少放，多次拿取”的弊端，使得实际使用中的加速效果大打折扣。
同时，剪枝后，通用的运行库（比如conv2d）不能用了，还得另行设计新的运算接口。So 麻烦。。