
神经网络基础介绍
深度学习基础














-
前期内容复习与知识点补充
- 复习内容梳理
- 神经网络基础公式:单神经元信号拟合公式为 Y = WX + B,多神经元叠加可统一为 W_iX_i 形式,隐含项 X0 固定为1对应偏置累加。
- 激活函数运行规则:信号传递前需标准化缩放至 0-1 区间,以 0.5 为阈值判断是否向下传递,是神经网络信号传递的核心规则。
- 人工智能分类体系:按技术路径分为有监督、无监督、半监督、自监督学习;按网络结构分为前馈、反馈、卷积等多类,包含 CNN、GNN、AE 等典型算法。
- 课程资料说明
- 复习资料发放:讲师已将汇总当日知识点的课堂要点思维导图上传至课程群,学员可直接使用该资料开展复习。
- 知识点补充规则:后续讲师将以思维导图形式补充零散知识点,无需学员自行整理汇总,按需查阅即可。
- 复习内容梳理
-
神经网络核心逻辑与原理解析
- 神经网络应用必要性:验证码、手写数字识别等存在大量随机干扰项的场景,无法通过枚举、常规 if-else 逻辑实现,需依赖神经网络。
- 图像数字化基础规则:图像分为彩色、灰度、黑白三类,彩色图为 RGB 三通道,单通道像素值取值范围为 0-255。
- 神经网络运行逻辑
- 层级对应关系:输入层对应图像像素点,隐藏层对应中层决策节点,输出层对应最终决策节点,全连接网络下所有节点均会传信号。
- 权重的实际含义:节点间连接的权重 W 对应决策节点对下属信号的信任程度,权重越高对应信号传递的优先级越高。
- 解释性差的原因:训练过程中权重 W 会动态调整,不同参数间存在相互影响,无法明确单个参数的具体作用。
- 内容甄别提示:网络上存在大量关于神经网络的错误教学内容,需以权威教材、官方资料为准,避免被错误信息误导。
-
参数与模型本质
- 参数迭代规则:训练初始需对权重做初始化,训练过程中所有参数动态调整,模型训练完成后参数固定,可通过微调优化。
- 深度的定义:神经网络的“深度”特指隐藏层的数量,理论上隐藏层越多可拟合的规律越复杂,层数过高会出现网络退化问题。
- 模型的本质:模型是训练完成后固定了所有参数的规律集合,可针对输入数据直接输出对应结果,核心作用是辅助决策与预测。
- 预测的属性:模型输出的预测值为不确定值,不存在100%准确率,不建议使用模型做股票等受多因素干扰的场景预测。
-
模型训练全流程与核心概念
-
标准训练流程:整体流程依次为数据准备、数据处理、模型训练、效果测试、部署上线,若测试不达标需返回前序环节迭代优化。
-
数据集划分规则
- 训练集规则:训练集需同时包含输入特征 X 与目标标签 Y,作用是供模型学习数据规律,拟合得到对应的 W、B 参数,常规占比约 70%。
- 测试集规则:测试集需同时包含 X 与 Y,作用是评估模型在未见过的新数据上的真实表现,仅可使用一次,常规占比约 30%。
- 验证集规则:验证集可反复使用,专门用于训练过程中的参数调整,避免测试集被提前使用导致评估结果失真。
-
核心概念定义
- 数据处理范畴:大模型场景下的数据处理包含数据过滤、缺失值处理、异常值处理、数据源合并等核心操作。
- 超参数定义:超参数为训练前需人工手动设置的参数,例如网络层数、神经元数量等,常规参数由模型自主迭代生成。
- 评估指标逻辑:模型评估核心指标包含准确率、查全率、查准率、F1 值,其中 F1 值为查全率与查准率的调和平均值。
- 任务类型区分:输出为离散分类标签的任务为分类任务,输出为连续数值的任务为回归任务,二者适用的模型逻辑存在明确差异。
-
】2.1 深度学习基础&spm=1001.2101.3001.5002&articleId=162526948&d=1&t=3&u=5011d1fad7f642b4994d7da75b7b711f)
4729

被折叠的 条评论
为什么被折叠?



