一、如何理解注意力机制
假设你正在阅读一本书,同时有人在你旁边说话。当你听到某些关键字时,比如“你的名字”或者“你感兴趣的话题”,你会自动把注意力从书上转移到他们的谈话上,尽管你并没有完全忽略书本的内容。这就是注意力机制的核心思想:动态地根据重要性来分配注意力,而不是对输入的信息一视同仁地处理。
在计算机视觉或自然语言处理(NLP)中,注意力机制让模型能够灵活地聚焦于输入数据的某些重要部分。例如,在图像分类任务中,模型不需要对整张图像的每一个像素都一视同仁,而是可以专注于那些关键区域,如目标物体的边缘或特征。在句子处理时,模型可以根据句子的上下文,专注于那些对语义理解最为关键的单词或短语,而忽略不太重要的部分。
注意力机制就像在复杂信息处理中自动筛选和重点关注的过程,帮助模型更智能地选择和处理最有用的信息。
作用
- 提升准确性:注意力机制聚焦关键信息,提升预测精度。
- 增强可解释性:能更清晰展示模型决策过程。
- 处理变长数据:适用于文本、语音等不定长序列数据。
不足
- 计算开销大:需要计算每个位置的权重,耗时长。
- 易过拟合:复杂权重可能导致模型在训练集上表现过好,泛化能力弱。
- 数据需求高:需要大量数据训练,否则效果不佳。
二、CBAM注意力机制
论文名称:《CBAM: Convolutional Block Attention Module》

CBAM从通道channel和空间spatial两个作用域出发,实现从通道到空间的顺序注意力结构。空间注意力可使神经网络更加关注在图像分类中决定性作用的像素区域而忽略无关紧要的区域,通道注意力则用于处理特征图通道的分配关系,同时对两个维度进行注意力分配加强了注意力机制对模型性能的提升效果。
2.1 CAM通道注意力模块

shared MLP

-
输入特征图(H×W×C):
- 先将输入的特征图(H×W×C)分别经过基于宽度和高度的最大池化和平均池化,对特征图按两个维度压缩,得到两个1×1×C的特征图。
-
池化后的特征图进行处理:
- 将最大池化和平均池化的结果利用共享的全连接层(Shared MLP)进行处理:
- 先通过一
- 将最大池化和平均池化的结果利用共享的全连接层(Shared MLP)进行处理:

——添加CBAM注意力机制&spm=1001.2101.3001.5002&articleId=142370523&d=1&t=3&u=2b4264da3ebc46afa4772088839e7d14)
719

被折叠的 条评论
为什么被折叠?



