【目标检测实验系列】YOLOv5创新点改进：高效通道注意力机制ECA与C3模块融合为新的C3ECA结构，加强模型对有效特征的提取能力，高效涨点！（内含源代码，超详细改进代码流程）

弗兰随风小欢

已于 2024-03-18 20:45:00 修改

阅读量1.5k

点赞数 16

分类专栏：目标检测实验系列文章标签：目标检测 YOLO YOLOv5 ECA注意力机制论文创新点魔改YOLO 深度学习

于 2023-12-25 21:59:35 首次发布

本文链接：https://blog.csdn.net/qq_32575047/article/details/135209784

版权

目标检测实验系列专栏收录该内容

15 篇文章 42 订阅

订阅专栏

自我介绍：本人硕士期间全程放养，目前成果:一篇北大核心CSCD录用,两篇中科院三区已见刊，一篇中科院三区在投。如何找创新点，如何放养过程厚积薄发，如何写中英论文，找期刊等等。本人后续会以自己实战经验详细写出来，还请大家能够点个关注和赞，收藏一下，谢谢大家。

1. 文章主要内容

本篇博客主要涉及通道注意力机制ECA与YOLOv5当中C3结构融合，从而设计一种新的C3ECA结构，让模型高效涨点。（通读本篇博客需要7分钟左右的时间）。

2. ECA通道注意力机制原理

简单的来讲是，ECA能够对通道维度的特征进行关注，提取到更多有用的数据目标信息。具体的原理解析推荐博客：ECA-Net：深度卷积神经网络的高效通道注意力机制。

3 详细代码改进流程(含本人经验)

3.1 ECA源代码(大家自己创建ECA.py文件)

import torch
from torch import nn

from models.common import Conv, Bottleneck


class ECAAttention(nn.Module):
    def __init__(self,  channel, kernel_size=5, stride=1, padding=1, gamma=2, b=1):
        super(ECAAttention, self).__init__()
        # k = int(abs((math.log(in_channel, 2) + b) / gamma))
        #kernel_size = k if k % 2 else k + 1
        padding = kernel_size // 2
        self.pool = nn.AdaptiveAvgPool2d(1)
        self.conv = nn.Sequential(
            nn.Conv1d(in_channels=1, out_channels=1, kernel_size=kernel_size,stride=stride, padding=padding, bias=False),
            nn.Sigmoid()
        )

    def forward(self, x):
        out = self.pool(x)
        out = out.view(x.size(0), 1, x.size(1))
        out = self.conv(out)
        out = out.view(x.size(0), x.size(1), 1, 1)
        return out * x

class C3ECA(nn.Module):
    def __init__(self, c1, c2, n=1, shortcut=True, g=1,
                 e=0.5):  # ch_in, ch_out, number, shortcut, groups, expansion #iscyy

        super(C3ECA, self).__init__()
        c_ = int(c2 * e)  # hidden channels
        self.eca = ECAAttention(2 * c_)
        self.cv1 = Conv(c1, c_, 1, 1)
        self.cv2 = Conv(c1, c_, 1, 1)
        self.cv3 = Conv(2 * c_, c2, 1)  # act=FReLU(c2)
        # self.m = nn.Sequential(*[CB2d(c_) for _ in range(n)])
        self.m = nn.Sequential(*[Bottleneck(c_, c_, shortcut, g, e=1.0) for _ in range(n)])

    def forward(self, x):
        out = torch.cat((self.m(self.cv1(self.eca(x))), self.cv2(self.eca(x))), dim=1)
        out = self.cv3(out)
        return out
if __name__ == '__main__':
    input = torch.randn(512, 512, 7, 7)
    pna = C3ECA(512, 512)
    output = pna(input)
    print(output.shape)

3.2 建立一个yolov5-eca.yaml文件

按本人经验来说，ECA属于通道注意力机制，YOLOv5中的C3结构分布在BackBone和Neck部分，层次越深，一般来讲通道维数就越高，通道里的特征就越丰富，所以尽量将ECA放在BackBone和Neck的后两个C3部分，不过因数据集的不同，并不一定放后面的效果好，大家可以多尝试，做一些消融的实验。本篇博客将C3ECA替换掉Backbone的后两个C3结构，具体的代码如下所示(注意nc改为自己数据集的类别)：

# YOLOv5 🚀 by Ultralytics, GPL-3.0 license

# Parameters
nc: 4  # number of classes
depth_multiple: 0.33  # model depth multiple
width_multiple: 0.50  # layer channel multiple
anchors:
  - [10,13, 16,30, 33,23]  # P3/8  小目标
  - [30,61, 62,45, 59,119]  # P4/16 中目标
  - [116,90, 156,198, 373,326]  # P5/32  大目标

# YOLOv5 v6.0 backbone
backbone:
  # [from, number, module, args]
  [[-1, 1, Conv, [64, 6, 2, 2]],  # 0-P1/2  output_channel, kernel_size, stride, padding
   [-1, 1, Conv, [128, 3, 2]],  # 1-P2/4
   [-1, 3, C3, [128]],
   [-1, 1, Conv, [256, 3, 2]],  # 3-P3/8
   [-1, 6, C3, [256]],
   [-1, 1, Conv, [512, 3, 2]],  # 5-P4/16
   [-1, 9, C3ECA, [512]],
   [-1, 1, Conv, [1024, 3, 2]],  # 7-P5/32
   [-1, 3, C3ECA, [1024]],
   [-1, 1, SPPF, [1024, 5]],  # 9
  ]

# YOLOv5 v6.0 head
head:
  [[-1, 1, Conv, [512, 1, 1]],
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 6], 1, Concat, [1]],  # cat backbone P4
   [-1, 3, C3, [512, False]],  # 13

   [-1, 1, Conv, [256, 1, 1]],
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 4], 1, Concat, [1]],  # cat backbone P3
   [-1, 3, C3, [256, False]],  # 17 (P3/8-small)

   [-1, 1, Conv, [256, 3, 2]],
   [[-1, 14], 1, Concat, [1]],  # cat head P4
   [-1, 3, C3, [512, False]],  # 20 (P4/16-medium)

   [-1, 1, Conv, [512, 3, 2]],
   [[-1, 10], 1, Concat, [1]],  # cat head P5
   [-1, 3, C3, [1024, False]],  # 23 (P5/32-large)
  
   [[17, 20, 23], 1, Detect, [nc, anchors]],  # Detect(P3, P4, P5)
  ]

3.3 将C3ECA引入到yolo.py文件中

在下图的位置处，引入相关的类即可。
在这里插入图片描述

3.4 修改train.py启动文件

修改配置文件为yolov5-eca.yaml即可，如下图所示：
在这里插入图片描述

4. 总结

本篇博客主要介绍了ECA融合到YOLOv5模型，从而设计一种新的结构C3ECA，增强模型对通道特征的提取能力，高效涨点。另外，在修改过程中，要是有任何问题，评论区交流；如果博客对您有帮助，请帮忙点个赞，收藏一下；后续会持续更新本人实验当中觉得有用的点子，如果很感兴趣的话，可以关注一下，谢谢大家啦！

弗兰随风小欢

关注

16
点赞
踩
37

收藏

觉得还不错? 一键收藏
打赏
3
评论
【目标检测实验系列】YOLOv5创新点改进：高效通道注意力机制ECA与C3模块融合为新的C3ECA结构，加强模型对有效特征的提取能力，高效涨点！（内含源代码，超详细改进代码流程）

【目标检测实验系列】YOLOv5创新点改进：高效通道注意力机制ECA与C3模块融合为新的C3ECA结构，加强模型对有效特征的提取能力，高效涨点！（内含源代码，超详细改进代码流程）
复制链接

扫一扫