神经网络与深度学习课程学习(二)

使用BK3432芯片进行蓝牙开发的详细指南:编程手册实际应用 BK3432是一款蓝牙4.2双模式芯片,支持蓝牙低功耗(BLE)和经典蓝牙(BR/EDR)模式。它集成了高性能的RF收发器、基带处理器、ARM9E内核、丰富的功能外设单元,并支持BLE应用的可编程协议和概要文件。蓝牙版本:4.2数据速率:最高支持2Mbps内核:ARM9ERF收发器:高性能、低功耗外设单元:包括UART、SPI、I2C、GPIO等功耗:超低功耗设计,适合电池供电的应用。 阅读详情

神经网络与深度学习课程学习(二)

一、为什么要深度学习?

深度学习是人工智能技术朝新的研究方向迈出的第一步。简单地说,深度学习包含了构建能够模仿人类大脑行为的神经网络。这些多层次的电脑网络像人类大脑一样, 可以收集信息,并基于收集到的信息产生相应的行为。这些电脑网络可以逐渐对事物的外形和声音进行感知和理解,也就是“认识”事物。比如,为了赋予机器“视觉”,研究人员需要建立最基本的一层人工神经元,用来探知如物体的边缘形状等基本信息,第二层神经元可以将第一层感知到了物体边缘性状拼凑 起来,鉴定较大块的物体形状,然后再加一层将第二层检测到的信息再拼凑从而使机器明白物体整体的形态。这里面关键的一点是,软件可以自行做到这一切——旧的“伪人工智能”往往需要工程师人工输入物体视觉或者声音的信息,然后由机器学习算法来处理这些信息数据。

深度学习包含的平台:

二、卷积神经网络基础

2.1进化史

2.2卷积神经网络基本概念。

构成:由多个卷积层和下采样层构成,后面可连接全连接网络

卷积层:𝑘个滤波器

下采样层:采用mean或max

后面:连着全连接网络

2.3经典BP算法

三、LeNet-5网络

由卷积层、池化层、全连接层和输出层构成

普遍规律:随网络深入,宽、高衰减,通道数增加

与现在网络区别:

-卷积时不进行填充(padding)

-池化层选用平均池化而非最大池化

-选用Sigmoid或tanh而非ReLU作为非线性环节激活函数

-层数较浅,参数数量小(约为6万)

四、基本卷积神经网络

       AlexNet

网络说明

网络一共有8层可学习层(5层卷积层和3层全连接层)

改进

池化层均采用最大池化

选用ReLU作为非线性环节激活函数

网络规模扩大,参数数量接近6000万

出现“多个卷积层+一个池化层”的结构

普遍规律

随着网络深入,宽、高衰减,通道数增加

1.最简单、通用的图像数据变形的方式:平移变换、反射变换、随机的光照

2. 采用ReLU替代 Tan Sigmoid 

3. 在每个全连接层后面使用一个 Dropout 层,以概率 p 随机关闭激活函数

4. AlexNet使用两块GTX580显卡进行训练,两块显卡只需要在特定的层进行通信

大模型时代的具身智能系列专题() 自由形式语言指令 L 指定了一个操作问题,例如“打开最顶部的抽屉”。然而,根据 L 生成机器人轨迹是很困难的,因为 L 可能具有任意长度,或者是不明确的(例如,需要上下文语义)。相反,我们专注于问题的各个阶段(子任务)l_i,它们明确地指定了一个操作任务 (例如,“抓住抽屉把手”,“打开抽屉”),其中被分解的子阶段(子任务)L→l1l2lnL→l1​l2​...ln​由高级规划器(例如,一个LLM或一个基于搜索的规划器)给出。 阅读详情

相关推荐

【CV论文精读】【BEV感知】BEVFormer:通过时空Transformer学习多摄像机图像的鸟瞰图表示

3D视觉感知任务,包括基于多摄像头图像的3D检测和地图分割,对于自动驾驶系统至关重要。在这项工作中,我们提出了一个称为BEVFormer的新框架,它通过时空Transformer学习统一的BEV表示,以支持多个自动驾驶感知任务。简而言之,BEVFormer通过预定义的网格形状的BEV queries空间和时间进行交互,从而利用空间和时间信息。为了聚集空间信息,我们设计了空间交叉注意力,每个BEV query从跨摄像机视图的感兴趣区域中提取空间特征。

weixin_44184852的博客 5988

神经网络深度学习课程总结

➢ 经典网络:以“一个或多个卷积层+一个池化层“作为一个基本单元进行堆叠,在网络尾部使用全连接层,最后以Softmax为分类器,输出结果。➢ 残差网络:在普通网络的基础上,将浅层的激活项通过支路直接传向深层,克服深层神经网络中梯度消失的问题,为训练极深的神经网络提供便利。➢ 数据集:常见的数据集包括VOC和COCO;ImageNet较大。

mrr_zhang的博客 1998

保姆级教程:在RV1126开发板上跑通YOLOv5口罩检测(从数据集到摄像头实时识别)

本文提供了一份详细的RV1126开发板部署YOLOv5口罩检测系统的全流程指南,涵盖数据集准备、模型训练优化、边缘部署及实时摄像头识别等关键步骤。重点解析了RV1126开发板的性能特征、YOLOv5模型训练调优技巧、RKNN模型转换量化策略,以及部署过程中的性能优化方案,帮助开发者高效实现边缘端目标检测应用。

weixin_27310985的博客 86

神经网络深度学习 课程学习总结(

相对的,只连接局部的元素,这使得网络结构更加灵活,可以捕捉到更多的图形特征。回归到人类的视觉系统,当人类去观察一个物体的时候,会更加的集中于这个物体本身,而忽略周围环境的影响,也就是说,人类观察事物时只观察了其视觉界面的局部画面,也就是带由目标事物的画面,这样可以更集中的观察到事物的细节特征。第三层使一个卷积层,输出的前10张特征图输入6张特征图中的4张进行连接,输出的后6张输入的6张特征图中的3张进行连接,同样的采用了大小为5×5的卷积核,步长为2进行卷积,第三层输出16张大小为10×10的特征图。

qq_63027657的博客 1621

神经网络深度学习课程总结(

摘要:本文系统介绍了神经网络性能优化方法卷积神经网络基础。性能优化部分涵盖模型初始化、数据分割、Dropout正则化等技术,分析了动量法和自适应梯度法(RMSProp/Adam)对SGD的改进。卷积神经网络部分阐述了局部连接和权值共享特性,详细解析了网络结构、前向/反向传播算法,并以LeNet-5、AlexNet和VGG-16为例说明了经典网络架构。全文从理论到实践,完整呈现了深度学习模型的设计优化思路,重点解决了过拟合、训练效率、梯度消失等关键问题。

m0_62248670的博客 1456

《2025神经网络深度学习课程笔记(

学习资源典型任务:图像分类(基于图像中主要对象分类)、目标定位(预测包含主要对象的图像区域)、目标识别(定位并分类图像中所有对象)、语义分割(按对象类别标记图像每个像素)、实例分割(按对象类别和实例标记图像每个像素)、关键点检测(检测对象预定义关键点位置)。进化史:1998 年出现 LeNet,之后陆续有 AlexNet、VGGNet、GoogleNet 等网络被提出,网络结构不断演进。

qq_51763264的博客 1247

深度学习神经网络课程总结(

后来,ResNeXt, Residual-Attention,DenseNet,SENet等也各有贡献,各自引入了Group convolution,Attention,Dense connection,channelwise-attention等,最终Imagenet上error rate降到了2.2%。对于算的慢问题,可以减少权值连接,每一个节点只连到上一层的少数神经元,即局部连接网络。CNN的基本思想是用卷积获得图形的特征,一般是用一个3乘3的卷积矩阵,如图所示的卷积矩阵是【1 0 1;

m0_74005431的博客 1133

神经网络深度学习课程内容总结

XOR问题是线性不可分问题的典型代表,单层感知机无法解决。本周课程系统介绍了多层前馈神经网络及其训练算法BP,以及各种性能优化技术。其中,三层阈值网络可实现任意值逻辑函数;三层S型网络可逼近紧集上的连续函数。这些内容为理解和应用深度学习奠定了坚实基础。:误差信号反向传播,利用梯度下降法调整权值和阈值。:训练时随机将部分神经元输出置零,防止过拟合。:输入信号从输入层经隐层传向输出层。

qq_73764753的博客 419

神经网络深度学习课程总结:卷积神经网络基础

本文总结了卷积神经网络(CNN)的基础理论经典架构,重点探讨了CNN在计算机视觉领域的应用。课程首先分析了全连接网络的缺陷,如参数爆炸、计算效率低下等问题,并引入局部连接参数共享的解决方案。随后,详细讲解了卷积操作、池化层及反向传播的数学原理,并通过LeNet-5手写数字识别实战展示了CNN的实际应用。此外,课程还介绍了AlexNet、VGG-16和ResNet等经典网络架构的演进创新,如ReLU激活函数、残差连接等。最后,课程概述了CV领域的核心数据集及其应用场景,为深度学习爱好者提供了全面的学习

qq_55200844的博客 899

神经网络深度学习课程总结(

PyTorch是一个Python的深度学习库。它最初由Facebook人工智能研究小组开发, 而优步的Pyro软件则用于概率编程。

gw1596662852的博客 273

深度学习】(四)案例:基于PyTorch的全连接神经网络实现手机价格区间预测

Jones创办了一家手手机公司,在经营过程中遇到了一个核心难题:如何准确估算手手机的合理售价。为了解决这个问题,他系统性地收集了多家手机销售公司的历史交易数据。该数据集包含了手手机的各项性能指标,以及对应的最终成交价格区间。价格被划分为0、1、2、3四个等级,分别代表从低到高的价格范围,这使得问题本质上成为一个多分类任务,而非传统的回归预测问题。特征名称含义说明单位电池总容量毫安时(mAh)blue是否支持蓝牙布尔值处理器主频GHzdual_sim是否支持双卡布尔值fc。

2503_91504671的博客 329

RNNoise:极小体积的实时降噪 baseline

RNNoise 是小模型也能做实用降噪的经典证明 —— 用 30 年 DSP 沉淀(Bark scale / BFCC / pitch analysis / comb filter)打底 · 只用 GRU 学最难手工调的那部分(每帧 22 个 band 该给多少 gain)· 换来 100 KB 的编译体积和 10 ms 延迟。这是端侧 real-time 场景(视频会议 · 通话 · WebRTC · Discord noise gate · 麦克风驱动层)至今仍常见的默认选择。

AI 音频小牛的博客 322

人工智能、机器学习深度学习到底是什么关系?

人工智能(AI)、机器学习(ML)和深度学习(DL)是三个层级嵌套的概念:DL⊂ML⊂AI。AI是最广泛的研究领域,关注机器完成智能任务的能力;ML是实现AI的一类方法,通过数据训练模型;DL则是ML的一个分支,使用多层神经网络自动学习特征表示。 具体区别体现在: AI包含规则系统和数据驱动方法,ML专注于从数据中学习规律 传统ML依赖人工特征工程,DL能自动提取多层次特征 DL在图像/语音/文本等非结构化数据上表现突出,但需要更多数据和算力 项目选择应基于任务特性:规则明确用编程,结构化小数据用传统ML(

Michael_Jay的博客 361

循环神经网络(RNN)详解:处理序列数据的自然选择

如果说CNN是处理“空间”信息的王者,那么RNN就是处理“时间”信息的自然选择。它通过循环连接和共享参数,让神经网络第一次拥有了“记忆”的能力,从而能够理解和生成序列数据。尽管基础RNN在长序列上遭遇了梯度问题,但LSTM和GRU等变体通过精妙的门控设计解决了这一挑战,让RNN家族在2010年代成为序列建模的中流砥柱。今天,Transformer架构在大规模语言建模中占据了主导地位,但RNN的设计智慧并未过时——残差连接门控机制状态传递等思想,早已融入现代深度学习的血脉。记住过去,理解当下。

jeffsonfu的专栏 616

深度学习基础-Harness:从评估框架到工程落地

深度学习工程语境中,Harness 通常指一套模型评测验证框架。它的核心目标是把「训练好的模型到底好不好」这件事从主观感受变成可重复、可量化的工程流程。统一的数据集加载接口,屏蔽不同数据来源的差异;标准化的推理流程,支持批量评测单条调试;可扩展的评估指标,如准确率、困惑度、ROUGE、F1 等;结果记录对比机制,便于多轮实验追踪。理解 Harness 之前,需要先回到它的上游基础:深度学习模型是如何被训练、推理和评估的。Harness 并不是某个特定框架的专属名称,而是一种。

2501_94116301的博客 347

BERT 微调电商评论情感分类实战:95.04% 准确率,预训练微调 vs 从零训练 LSTM

任务:电商评论情感分类(正面 / 负面)模型路线:BERT 预训练编码器(1.02 亿参数)+ 线性分类头(BCE 路线,输出 1 个 logit)实测结果:测试集准确率95.04%(LSTM 项目为 91.48%)💡 这个项目的独特价值:作者此前从零训练的 LSTM 情感分类项目(同数据集、同任务、同 SEQ_LEN,是"预训练微调 vs 从零训练"最公平的对照实验。

zylyw123的博客 289

深度学习 & PyTorch笔记

深度学习基础概念、梯度下降原理 → PyTorch 框架、张量科学计算 → 网络组件、三种模型搭建方式**完整串联;同时对比传统 sklearn,厘清同义术语,配套可运行代码示例,打通理论和编程实践。

206

【免费】基于YOLO26的车辆车牌识别系统(深度学习+LPRNet+CCPD+PyQt6) 人工智能 机器视觉 计算机视觉 锋哥原创出品,必属精品

本文介绍了一个基于YOLO26的车辆车牌识别系统,该系统采用深度学习技术实现车牌自动识别。系统主要由车牌检测(YOLO26-Pose)和字符识别(LPRNet)两阶段组成,支持处理倾斜、双层车牌,并能区分蓝牌、绿牌和黄牌。系统采用Python3.11开发,PyQt6构建图形界面,包含图片/视频/摄像头识别、历史记录查询等功能,数据存储在MySQL数据库中。测试表明系统能有效识别多种车牌类型,适合停车场管理等场景应用。项目完整源码已提供下载链接。

java1234的博客 1134

AI基础系列(3)| NumPy / Pandas / PyTorch 理论知识入门:数据科学深度学习的三大基石

本文系统梳理了NumPy、Pandas和PyTorch三大Python库的核心理论,为企业AI转型提供技术支撑。NumPy的ndarray、向量化运算和广播机制构成数值计算基础;Pandas通过索引对齐和分组聚合处理结构化数据;PyTorch的动态计算图实现自动微分GPU加速。三者相互补充,形成完整AI技术栈。文章强调理解底层原理的重要性,建议从业者从基础数组操作逐步深入至神经网络构建,并针对常见问题提供解决方案。随着AI技术普及,掌握这些核心库的底层理论将成为开发高效可靠AI系统的关键。

CIO_Alliance的博客 219

【第8篇】OverLock(CVPR2025):新型卷积神经网络OverLoCK,通用的即插即用Backbone!

本文介绍 CVPR 2025 纯卷积视觉网络 OverLoCK。模型提出 Deep-stage Decomposition Strategy(深度阶段分解策略,DDS) Context-Mixing Dynamic Convolution(上下文混合动态卷积,ContMix),分别解决“高层语义如何反向指导特征提取”和“卷积如何兼顾长程依赖局部归纳偏置”两个问题。

weixin_38647644的博客 189

ASR 五代演进(三):Gen 2 · 端到端(CTC / LAS / RNN-T)

Gen 2 是 ASR 从 hybrid pipeline 转向端到端建模的一次大拐弯。;生产系统里的降噪、VAD、热词、外挂 LM、rescore 仍常保留,存量电话客服 / IVR 也长期继续跑 Kaldi chain / hybrid 系统。引爆点是解决了「音频帧数远多于文本 token、训练集又没有逐帧对齐」的问题。

AI 音频小牛的博客 232

国产操作系统/中标麒麟/银河麒麟 操作系统【ISO镜像完整版合集 共计20G】

麒麟桌面操作系统软件(龙芯版)V7.0 麒麟桌面操作系统软件(兆芯版)V7.0 麒麟高级服务器操作系统软件V7.0 update6 麒麟高级服务器操作系统软件(海光版)V7.0 麒麟高级服务器操作系统软件(龙芯64位)V7.0 麒麟高级服务器操作系统软件(ARM64版)V7.0 麒麟高级服务器操作系统软件(兆芯版)V7.0中标普华Office7.0专业版 FOR 32位windows中标普华Office7.0专业版 FOR 64位中标麒麟7.0桌面操作系统(x86)麒麟桌面操作系统源代码 麒麟服务器操作系统源代码

毕业设计MATLAB_货币识别.zip

毕业设计MATLAB源码资料

上一篇: 神经网络与深度学习课程总结(一)
下一篇: 神经网络课程学习3
qwertyf123
博客等级 码龄5年 40粉丝 4原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值