好好学习才能玩
码龄4年
求更新 关注
提问 私信
  • 博客:4,692
    4,692
    总访问量
  • 12
    原创
  • 0
    粉丝
  • 45
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:江西省
加入CSDN时间: 2022-12-30
博客简介:

2202_76127174的博客

查看详细资料
个人成就
  • 获得130次点赞
  • 内容获得1次评论
  • 获得61次收藏
  • 博客总排名69,717名
  • 原力等级
    原力等级
    1
    原力分
    0
    本月获得
    90
创作历程
  • 12篇
    2026年
成就勋章

TA关注的专栏 1

TA关注的收藏夹 0

TA关注的社区 5

TA参与的活动 0

兴趣领域 设置
  • 编程语言
    c语言
创作活动更多

编程达人挑战赛·第12期

作为写代码的你,是否也渴望被更多人看到?技术人员普遍有一个共性——明明技术很强,却没人知道你做了什么;花了很多时间踩坑,却没人因你少走弯路;脑子里有一堆干货,但却不懂如何有效地输出。 在如今写代码的人越来越多的时代,能够清晰表达自己思路与技术的人却少之又少。 因此,我们发起了这个【编程达人挑战赛】——帮助你将代码变成作品,将技术转化为真正的价值,同时激励更多的人坚持写作与分享。 注:活动细则介绍请看此贴:[https://bbs.csdn.net/topics/619791811](https://bbs.csdn.net/topics/619791811)。

725人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

深度学习入门到入神|第八关:ReLU 不改变 Shape,为什么却这么重要?

本文围绕 ReLU(Rectified Linear Unit,修正线性单元)展开,从“连续线性变换仍然可以合并”为切入点,说明激活函数为什么能够为神经网络加入非线性表达能力,并结合 Conv → BN → ReLU 梳理三者在 CNN 中各自承担的作用。
原创
博文更新于 10 小时前 ·
205 阅读 ·
11 点赞 ·
0 评论 ·
1 收藏

深度学习入门到入神|第八关:ReLU 到底做了什么?为什么神经网络一定需要激活函数?

本文围绕 ReLU(Rectified Linear Unit,修正线性单元)展开,讲清 nn.ReLU() 和 F.relu(x) 到底做了什么。通过公式 f(x)=max(0,x) 和实际 Tensor 数值变化,解释 ReLU 为什么会把负值截断为 0、保留正值,以及为什么它通常不会改变 Tensor Shape。进一步从“连续线性变换仍然可以合并”为切入点,说明激活函数为什么能够为神经网络加入非线性表达能力,并结合 Conv → BN → ReLU 梳理三者在 CNN 中各自承担的作用。
原创
博文更新于 10 小时前 ·
217 阅读 ·
7 点赞 ·
0 评论 ·
3 收藏

深度学习入门到入神|第七关:nn.BatchNorm2d(64) 里的 64 到底是什么?为什么必须和通道数对应?

nn.BatchNorm2d(64) 里的 64 不是 Batch Size,而是输入 Tensor [B,C,H,W] 中的 Channel 数 C。当 Conv2d(..., out_channels=64) 输出 [B,64,H,W] 后,后面的 BatchNorm2d(64) 就负责处理这 64 个 Channel。BN 会把每个 Channel 分开,在对应的 B×H×W 元素上计算统计量并调整数值,因此它改变的是 Tensor 内部的数值,而不是 Shape,输出仍然保持 [B,C,H,W]。
原创
博文更新于 前天 22:21 ·
457 阅读 ·
16 点赞 ·
0 评论 ·
8 收藏

深度学习入门第七关:BatchNorm2d(64) 里的 64 到底是什么?BN 到底在归一化什么?

本文围绕 nn.BatchNorm2d(64) 展开,重点解释其中的 64 为什么对应 Channel。通过 [8,64,32,32] 的 Tensor Shape,讲清 BatchNorm2d如何按 Channel 分别统计 B、H、W 维度上的特征,并进一步理解均值、方差、标准化、可学习参数 γ 和 β,以及 Conv → BN → ReLU 为什么会成为 CNN 中常见的基础结构。文章同时梳理了 BN 对 Tensor Shape 的影响,以及训练和测试阶段下 BatchNorm 行为区别。
原创
博文更新于 前天 21:58 ·
403 阅读 ·
13 点赞 ·
0 评论 ·
5 收藏

深度学习入门到入神·秘境地图01:从 Tensor 到 Residual,前六关知识路线图

本文作为“深度学习入门到入神”系列的第一张秘境地图,对前六关 Tensor、Conv2d、Pooling、Flatten、GAP 与 Residual 进行阶段性梳理。文章不引入新的知识点,而是围绕 Tensor Shape 的变化,将六个看似独立的概念重新串联起来,明确当前已经具备的代码阅读、Shape 推导与基础网络结构理解能力。同时通过若干基于前六关知识延伸出的隐藏问题,帮助初学者检查自己是否真正理解了各知识点之间的联系,并确定目前在深度学习学习路线中的位置。
原创
博文更新于 前天 17:07 ·
307 阅读 ·
7 点赞 ·
0 评论 ·
7 收藏

深度学习入门第六关:Residual 到底是什么?为什么 x + F(x) 可以直接相加?

本文从 PyTorch 中最常见的 out = F(x) + x 出发,系统讲解 Residual Connection(残差连接)的核心思想。通过 Tensor Shape 变化解释为什么两个特征相加前需要对齐、为什么 64 Channel 和 128 Channel 不能直接 Add,以及 1×1 Conv 如何完成 Channel 和空间尺寸匹配。同时结合 Shortcut(跳跃连接)、Add 与 Cat 的区别,帮助初学者从“会看代码”进一步理解 ResNet 中残差结构为什么能够帮助深层网络训练。
原创
博文更新于 2026.08.16 ·
253 阅读 ·
5 点赞 ·
0 评论 ·
4 收藏

深度学习入门到入神·悟道篇01:Tensor 变形术——Flatten、GAP、mean、keepdim 到底差在哪?

本篇作为“深度学习入门到入神·悟道篇 01”,集中梳理 torch.flatten(x,1)、AdaptiveAvgPool2d((1,1))、mean(dim=(2,3)) 和 keepdim=True 四种常见 Tensor 操作。通过统一输入 [8,128,8,8] 对比它们的计算方式、输出 Shape 和实际用途,帮助初学者真正理解维度变化,而不是只会机械记代码。
原创
博文更新于 2026.08.16 ·
418 阅读 ·
4 点赞 ·
0 评论 ·
9 收藏

深度学习入门第五关:Global Average Pooling 到底是什么?为什么能把 [8,128,8,8] 变成 [8,128]?

Global Average Pooling(GAP)是 CNN 中非常常见的操作。本文从 [8,128,8,8] 的 Tensor 出发,结合 nn.AdaptiveAvgPool2d((1,1)) 的完整代码,讲清 GAP 如何把每个 Channel 的整张 Feature Map 求平均并压缩为 1×1,为什么 Channel 数不变,以及 GAP 与普通 Average Pooling、Flatten 的核心区别。
原创
博文更新于 2026.08.15 ·
273 阅读 ·
6 点赞 ·
0 评论 ·
6 收藏

深度学习入门第四关:torch.flatten(x, 1) 到底是什么意思?

torch.flatten(x, 1) 是 PyTorch 中非常常见的操作,但很多初学者并不理解其中的 1 到底代表什么。本文从 Tensor 的 [B,C,H,W] 结构出发,讲清 Flatten 如何把 [8,128,8,8] 变成 [8,8192],并解释 Batch、全连接层、空间结构以及 Flatten 与 GAP 的区别。
原创
博文更新于 2026.08.14 ·
565 阅读 ·
16 点赞 ·
0 评论 ·
6 收藏

深度学习入门第三关:Pooling 到底在“池化”什么?MaxPool 和 AvgPool 一次讲明白

把一个局部区域中的多个值压缩成一个值。保留局部最大值。保留局部平均值。常见的H、W 减半C 通常不变↓而 Pooling 和Pooling 使用固定规则下采样;stride=2 Conv 可以一边学习特征,一边完成下采样。
原创
博文更新于 2026.08.14 ·
448 阅读 ·
14 点赞 ·
0 评论 ·
4 收藏

深度学习入门第二关:Conv2d 到底做了什么?从 [8,3,256,256] 到 [8,64,128,128] 一次讲明白

这一篇最重要的其实只有5句话。
原创
博文更新于 2026.08.13 ·
583 阅读 ·
20 点赞 ·
0 评论 ·
2 收藏

深度学习入门第一关:Tensor 到底是什么?一次看懂 [B, C, H, W]

B = 一次处理多少个样本C = 有多少个特征通道H = 特征图高度W = 特征图宽度C可能表示RGBC通常表示不同的Feature MapH、W逐渐减小C逐渐增加。
原创
博文更新于 2026.08.13 ·
561 阅读 ·
11 点赞 ·
1 评论 ·
6 收藏