【CNN】
[2024] OneNet: A Channel-Wise 1D Convolutional U-Net
论文链接:https://arxiv.org/pdf/2411.09838v1
代码链接:https://github.com/shbyun080/OneNet
许多先进的计算机视觉架构利用U-Net的适应性和高效特征提取能力。然而,多分辨率卷积设计通常会导致显著的计算需求,限制了其在边缘设备上的部署。文中提出了一种简化的替代方案:一个1D卷积编码器,它保留了U-Net的准确性,同时增强了对边缘应用的适用性。新的编码器架构通过通道级1D卷积结合像素解混操作实现语义分割。通过引入PixelShuffle,这种在超分辨率任务中提高准确性的同时减少计算负载的方法,OneNet在不使用2D卷积的情况下捕捉空间关系,参数减少了多达47%。此外,作者探索了一种完全1D的编码解码器,其大小减少了71%,尽管存在一些准确性损失。将这种方法与不同变体的U-Net在各种掩码生成任务上进行了基准测试,证明其有效保持了准确性。虽然专注于图像分割,但这种架构可以适应其他卷积应用。



实验结果:

【模型压缩】
[TPAMI 2024] Latency-aware Unified Dynamic Networks for Efficient Image Recognition
论文链接:https://arxiv.org/pdf/2308.15949
代码链接:https://www.github.com/LeapLabTHU/LAUDNet
动态计算已成为提高深度网络推理效率的一种有前景的方法。它允许选择性激活计算单元,从而减少每个输入样本不必要的计算量。然而,这些动态模型的实际效率可能与理论预测存在偏差。这种不匹配源于:1)由于研究分散,缺乏统一的方法;2)过于关注算法设计而忽略了关键的调度策略,特别是在支持CUDA的GPU环境中;3)在测量实际延迟方面面临挑战,因为大多数库都针对静态操作。为了解决这些问题,作者提出了Latency-Aware Unified Dynamic Networks(LAUDNet),这是一个框架,集成了三种主要的动态范式——空间自适应计算、动态层跳过和动态通道跳过。为了弥合理论与实际效率之间的差距,LAUDNet将算法设计与调度优化相结合,由一个能够准确评估动态操作延迟的延迟预测器指导。在多个视觉任务上测试了LAUDNet,证明了其在V100、RTX3090和TX2 GPU等平台上将ResNet-101等模型的延迟减少了50%以上的能力。值得注意的是,LAUDNet在平衡准确性和效率方面表现突出。


实验结果:

【图像修复】
[2024 图像去模糊] Multi-scale Frequency Enhancement Network for Blind Image Deblurring
论文链接:https://arxiv.org/pdf/2411.06893
代码链接:无



实验结果:



502

被折叠的 条评论
为什么被折叠?



