一、本文介绍
作为入门性篇章,这里介绍了SCAM注意力在YOLOv8中的使用。包含SCAM原理分析,SCAM的代码、SCAM的使用方法、以及添加以后的yaml文件及运行记录。
二、SCAM原理分析
SCAM官方论文地址:SCAM文章
SCAM官方代码地址:SCAM代码
SCAM注意力机制(空间上下文感知模块):
空间上下文感知模块(SCAM)在FEM和FFM之后,特征映射已经考虑了局部上下文信息,并且能够很好地表示小对象特征。在此阶段对小目标和背景之间的全局关系进行建模比在主干阶段更有效。利用全局上下文信息来表示像素之间的跨空间关系,可以抑制无用背景,增强目标和背景的区分能力。受GCNet和SCP的启发,SCAM由三个分支组成。第一个部分使用GAP和GMP整合全球信息。第二个分支使用1 × 1卷积生成特征映射的线性变换结果,该特征映射在图4中称为value。第三个分支使用1 × 1卷积来简化查询和键的倍数。这个卷积在图4中称为QK。随后,将第一分支和第三分支分别与第二分支矩阵相乘。得到的两个分支分别表示跨通道和空间的上下文信息。最后,利用广播Hadamard积在这两个分支上得到了SCAM的输出。
相关代码:
SCAM注意力的代码,如下。
class SCAM(nn.Module):
def __init__(self, in_channels, reduction=1):
super(SCAM, self).__init__()
self.in_channels = in_channels
self.inter_channels = in_channels
self.k = Conv(in_channels, 1, 1, 1)
self.v = Conv(in_channels, self.inter_channels, 1, 1)
self.m = Conv_withoutBN(self.inter_channels, in_channels, 1, 1)
self.m2 = Conv(2, 1, 1, 1)
self.avg_pool = nn.AdaptiveAvgPool2d(1) # GAP
self.max_pool = nn.AdaptiveMaxPool2d(1) # GMP
def forward(self, x):
n, c, h, w = x.size(0), x.size(1), x.size(2), x.size(3)
# avg max: [N, C, 1, 1]
avg = self.avg_pool(x).softmax(1).view(n, 1, 1, c)
max = self.max_pool(x).softmax(1).view(n, 1, 1, c)
# k: [N, 1, HW, 1]
k = self.k(x).view(n, 1, -1, 1).softmax(2)
# v: [N, 1, C, HW]
v = self.v(x).view(n, 1, c, -1)
# y: [N, C, 1, 1]
y = torch.matmul(v, k).view(n, c, 1, 1)
# y2:[N, 1, H, W]
y_avg = torch.matmul(avg, v).view(n, 1, h, w)
y_max = torch.matmul(max, v).view(n, 1, h, w)
# y_cat:[N, 2, H, W]
y_cat = torch.cat((y_avg, y_max), 1)
y = self.m(y) * self.m2(y_cat).sigmoid()
return x + y
四、YOLOv8中SCAM使用方法
1.YOLOv8中添加SCAM模块:
首先在ultralytics/nn/modules/conv.py最后添加SCAM模块的代码。
2.在conv.py的开头__all__ = 内添加SCAM模块的类别名:
3.在同级文件夹下的__init__.py内添加SCAM的相关内容:(分别是from .conv import SCAM ;以及在__all__内添加SCAM)
4.在ultralytics/nn/tasks.py进行LSKA注意力机制的注册,以及在YOLOv8的yaml配置文件中添加SCAM即可。
首先打开task.py文件,按住Ctrl+F,输入parse_model进行搜索。找到parse_model函数。在其最后一个else前面添加以下注册代码:
elif m is SCAM:
c2 = ch[f]
args = [c2]
然后,就是新建一个名为YOLOv8_SCAM.yaml的配置文件:(路径:ultralytics/cfg/models/v8/YOLOv8_SCAM.yaml)
# Ultralytics YOLO
标签:SCAM,Conv,self,YOLOv8,channels,C2f,注意力
From: https://blog.csdn.net/2301_79619145/article/details/142660726