Unet在图像分割领域的应用已经许久。2025年了,Unet还有哪些创新点呢?
Unet凭借其卓越的图像分割能力成为计算机视觉领域的热点。CNN的长距离建模能力不足,而Transformer的计算复杂度高,这两个模型与Unet结合都存在各种问题。而最先在时序预测领域大火的mamba这类状态空间模型,具有长距离建模能力,且在表现不输transformer的前提下,同时避免了计算上的二次时间复杂度而被各领域关注。
以mamba为首的选择性状态空间模型与Unet到底能擦出怎样的火花?Unet + SSM的思路已成为图像分割领域宠儿!我精心整理的6篇Unet + mamba的图像分割领域论文将为大家提供图像分割方向全面的融合改进思路~
点击【AI十八式】的主页,获取更多优质资源!
一、VM-UNet: Vision Mamba UNet for Medical Image Segmentation

1.方法
-
模型架构:
-
提出VM-UNet,基于纯状态空间模型(SSM),采用U型结构,包含编码器、解码器和跳跃连接。
-
编码器:由VSS(Visual State Space)块构成,结合下采样(Patch Merging)操作提取多尺度特征,通道数逐级增加(C → 8C)。
-
解码器:同样使用VSS块,通过上采样(Patch Expanding)恢复分辨率,通道数逐级减少(8C → C)。
-
跳跃连接:采用简单的加法操作融合编
-


993

被折叠的 条评论
为什么被折叠?



