YOLOv11 改进 - SPPF模块 | 发论文神器！LSKA注意力改进SPPF,增强多尺度特征提取能力，高效涨点！！！

原创已于 2025-12-09 20:35:48 修改 · 1.1k 阅读

19 GEO检测

标签

#YOLO #人工智能 #目标检测 #计算机视觉 #深度学习

于 2025-11-26 21:22:29 首次发布

最新YOLOv11改进专栏专栏收录该内容

193 篇文章 ¥99.90 ¥299.90

订阅专栏

低功耗蓝牙项目，需要一块懂省电的板

思澈 SF32LB52 芯片，BLE 协议栈深度优化，上手即开发

点击查看

前言

本文介绍了Large Separable Kernel Attention (LSKA)模块及其在YOLOv11中的结合应用。LSKA旨在解决Visual Attention Networks (VAN)使用大内核卷积时的计算效率问题，通过将2D深度卷积层的卷积核分解为级联的水平和垂直1-D卷积核，降低了计算复杂度和内存占用，且使VAN更关注物体形状。我们将集成LSKA的SPPF_LSKA模块引入YOLOv11，大量实验表明，改进后的模型在对象识别、检测、分割和稳健性测试上表现出色。

文章目录： YOLOv11改进大全：卷积层、轻量化、注意力机制、损失函数、Backbone、SPPF、Neck、检测头全方位优化汇总

专栏链接: YOLOv11改进专栏

介绍

摘要

配备大卷积核注意力（LKA）模块的视觉注意力网络（VAN）在多种视觉任务中展现出卓越性能，超越了视觉Transformer（ViTs）的表现。然而，LKA模块中的深度卷积层随着卷积核尺寸的增大，会导致计算复杂度与内存占用的二次增长。为解决此问题并实现在VAN注意力模块中使用超大卷积核的目标，本研究提出了一个名为LSKA的大可分卷积核注意力模块家族。LSKA通过将深度卷积层的二维卷积核分解为串联的水平与垂直一维卷积核，实现了对标准LKA设计的改进。这种分解策略使得无需额外模块即可在注意力模块中直接使用配备大卷积核的深度卷积层。实验验证表明，在VAN中部署的LSKA模块能够在显著降低计算复杂度与内存占用的同时，达到与标准LKA模块相当的性能水平。研究还发现，随着卷积核尺寸的增加，所提出的LSKA设计使VAN更加关注物体形状特征而非纹理信息。此外，我们在五种受损版本的ImageNet数据集上对VAN、ViTs以及最新ConvNeXt架构中的LKA和LSKA模块进行了系统性稳健性基准测试，这些数据集在先前研究中较少被探索。大量实验结果表明，随着卷积核尺寸的增大，所提出的VAN中LSKA模块显著降低了计算复杂度与内存占用，同时在目标识别、目标检测、语义分割及稳健性测试中表现优于ViTs和ConvNeXt，并与VAN中LKA模块保持相当性能。相关代码已公开于https://github.com/S

低功耗蓝牙项目，需要一块懂省电的板

思澈 SF32LB52 芯片，BLE 协议栈深度优化，上手即开发

点击查看

了解本专栏