MegEngine 7-8 双月报来啦:新版本发布,开发者福利课程,干货满满

  • v1.13.0 新版本发布

https://github.com/MegEngine/MegEngine/releases/tag/v1.13.0

  • MegCC 新版本发布

https://github.com/MegEngine/MegCC/releases/tag/v0.1.5

  • 【MegEngine 使用小技巧】系列文章
  1. MegEngine 使用小技巧:Profiler 使用手册

  2. MegEngine 使用小技巧:如何使用 MegCC 进行模型编译

  • Imperative 介绍专栏
  1. MegEngine Python 层模块串讲(上)

  2. MegEngine Python 层模块串讲(中)

  3. MegEngine Python 层模块串讲(下)

如有催更或投稿,欢迎联系我们哦~

技术交流 QQ 群:1029741705;Bot 微信:megengine-bot

  • 开源项目分享,实习宝典传授,直播课程报名开启!

SAM 带来的思考与未来;基于 MegCC 的模型推理优化;实习求职宝典;开源大赛分享
9 月 9 日(周六)19:00-20:00 ,立即报名:http://i8x1e20aau991m05.mikecrm.com/63Wre15
精彩课程干货满满,更有直播间有奖答疑互动,精美礼品等你来拿!
在这里插入图片描述

RNNoise:极小体积的实时降噪 baseline RNNoise 是小模型也能做实用降噪的经典证明 —— 用 30 年 DSP 沉淀(Bark scale / BFCC / pitch analysis / comb filter)打底 · 只用 GRU 学最难手工调的那部分(每帧 22 个 band 该给多少 gain)· 换来 100 KB 的编译体积和 10 ms 延迟。这是端侧 real-time 场景(视频会议 · 通话 · WebRTC · Discord noise gate · 麦克风驱动层)至今仍常见的默认选择。 阅读详情

相关推荐

人工智能、机器学习和深度学习到底是什么关系?

人工智能(AI)、机器学习(ML)和深度学习(DL)是三个层级嵌套的概念:DL⊂ML⊂AI。AI是最广泛的研究领域,关注机器完成智能任务的能力;ML是实现AI的一类方法,通过数据训练模型;DL则是ML的一个分支,使用多层神经网络自动学习特征表示。 具体区别体现在: AI包含规则系统和数据驱动方法,ML专注于从数据中学习规律 传统ML依赖人工特征工程,DL能自动提取多层次特征 DL在图像/语音/文本等非结构化数据上表现突出,但需要更多数据和算力 项目选择应基于任务特性:规则明确用编程,结构化小数据用传统ML(

Michael_Jay的博客 327

循环神经网络 RNN、LSTM、GRU 是什么?为什么能处理序列?

上篇我们聊完CNN,看它怎么像放大镜一样,逐块扫图像、提取特征。 但有一类数据,CNN处理起来很吃力——什么数据呢? 有时间顺序的数据。 你跟 Siri 说的那句"嘿,明天早上七点叫我起床"——这串声音信号得按顺序听完,才能理解意思。

404 Not Found 541

深度学习到底是什么?它和机器学习有什么区别?

你有没有想过,为什么现在解锁手机只要看一眼、翻译外语拍张照就能出结果、下棋甚至能赢过世界冠军? 这些事情听起来像科幻,但背后靠的是同一个技术——深度学习

404 Not Found 1503

AI与深度学习:从原理到应用

深度学习是人工智能领域过去十年最激动人心的突破。从识别一张图片中的猫,到与人类进行流畅对话,再到辅助医生拯救生命,深度学习正在不断拓展机器能力的边界。它不是魔法,而是数学、算法和数据的精妙结合。理解深度学习的基本原理,不仅能帮助我们更好地使用这些工具,也能让我们在这个AI驱动的时代中,做出更明智的判断和选择。未来已来,而深度学习正是那扇通往未来的大门。

m0_73407070的博客 442

卷积神经网络一:CNN 核心 —— 卷积、池化与特征提取

卷积神经网络一:CNN 核心 —— 卷积、池化与特征提取

root_123456_的博客 266

基于杰理AC7016C的GTCRN门控卷积神经网络语音增强方法

【摘要】GTCRN是一种超轻量级语音增强模型,专为边缘设备(如蓝牙耳机、会议系统)设计,仅48K参数即可实现高效实时降噪。其核心创新在于门控时序卷积、分组策略和轻量循环网络的三重优化,以33.0MMACs的计算量超越传统算法(如RNNoise),性能接近计算量高10倍的DeepFilterNet(PESQ 2.87)。该模型已开源并发表于ICASSP 2024,支持ONNX部署,适用于车载语音、智能音箱等低功耗场景。(149字)

2401_89373706的博客 201

深度学习基础-Harness:从评估框架到工程落地

深度学习工程语境中,Harness 通常指一套模型评测与验证框架。它的核心目标是把「训练好的模型到底好不好」这件事从主观感受变成可重复、可量化的工程流程。统一的数据集加载接口,屏蔽不同数据来源的差异;标准化的推理流程,支持批量评测与单条调试;可扩展的评估指标,如准确率、困惑度、ROUGE、F1 等;结果记录与对比机制,便于多轮实验追踪。理解 Harness 之前,需要先回到它的上游基础:深度学习模型是如何被训练、推理和评估的。Harness 并不是某个特定框架的专属名称,而是一种。

2501_94116301的博客 305

【超详细】CREPE 与 SPICE:深度学习基频检测的原理、架构与实践

摘要 本文系统介绍了基于深度学习的基频检测方法,重点分析了CREPE和SPICE两种模型。传统方法依赖手工特征设计,难以应对真实音频的多样性。CREPE通过卷积神经网络将基频检测转化为分类问题,采用六层一维卷积架构和概率分布输出,实现了高精度估计。SPICE则在保持性能的前提下,通过深度可分离卷积等技术大幅降低计算量,适合移动端部署。文章详细阐述了模型架构、训练策略(如数据增强和标签软化)及实际部署方案,展现了深度学习在基频检测领域的优势与潜力。

民乐团扒谱机的博客 492

深度学习 & PyTorch笔记

深度学习基础概念、梯度下降原理 → PyTorch 框架、张量科学计算 → 网络组件、三种模型搭建方式**完整串联;同时对比传统 sklearn,厘清同义术语,配套可运行代码示例,打通理论和编程实践。

188

基于贝叶斯优化的BiLSTM(BO-BiLSTM)一维时间序列预测算法matlab仿真

本文提出了一种基于贝叶斯优化(BO)和向长短期记忆网络(BiLSTM)组合的时间序列预测方法BO-BiLSTM。该方法通过贝叶斯优化自动搜索BiLSTM的关键超参数(如学习率、神经元数量、窗口长度等),以提升模型预测精度。文章详细阐述了BiLSTM原理、贝叶斯优化的高斯过程代理模型和采集函数机制,并给出了完整的实现步骤:包括数据预处理、超参数空间定义、目标函数构建、贝叶斯优化迭代等流程。实验结果表明,该方法能有效降低预测误差,附带的MATLAB程序工程展示了训练集/测试集的预测效果对比图和误差分析图。该集

MATLAB,verilog,python,opencv,tensorflow,caffe,C,C++ 223

【免费】基于YOLO26的车辆车牌识别系统(深度学习+LPRNet+CCPD+PyQt6) 人工智能 机器视觉 计算机视觉 锋哥原创出品,必属精品

本文介绍了一个基于YOLO26的车辆车牌识别系统,该系统采用深度学习技术实现车牌自动识别。系统主要由车牌检测(YOLO26-Pose)和字符识别(LPRNet)两阶段组成,支持处理倾斜、层车牌,并能区分蓝牌、绿牌和黄牌。系统采用Python3.11开发,PyQt6构建图形界面,包含图片/视频/摄像头识别、历史记录查询等功能,数据存储在MySQL数据库中。测试表明系统能有效识别多种车牌类型,适合停车场管理等场景应用。项目完整源码已提供下载链接。

java1234的博客 708

AI基础系列(3)| NumPy / Pandas / PyTorch 理论知识入门:数据科学与深度学习的三大基石

本文系统梳理了NumPy、Pandas和PyTorch三大Python库的核心理论,为企业AI转型提供技术支撑。NumPy的ndarray、向量化运算和广播机制构成数值计算基础;Pandas通过索引对齐和分组聚合处理结构化数据;PyTorch的动态计算图实现自动微分与GPU加速。三者相互补充,形成完整AI技术栈。文章强调理解底层原理的重要性,建议从业者从基础数组操作逐步深入至神经网络构建,并针对常见问题提供解决方案。随着AI技术普及,掌握这些核心库的底层理论将成为开发高效可靠AI系统的关键。

CIO_Alliance的博客 197

【第8篇】OverLock(CVPR2025):新型卷积神经网络OverLoCK,通用的即插即用Backbone!

本文介绍 CVPR 2025 纯卷积视觉网络 OverLoCK。模型提出 Deep-stage Decomposition Strategy(深度阶段分解策略,DDS)与 Context-Mixing Dynamic Convolution(上下文混合动态卷积,ContMix),分别解决“高层语义如何反向指导特征提取”和“卷积如何兼顾长程依赖与局部归纳偏置”两个问题。

weixin_38647644的博客 172

ASR 五代演进(三):Gen 2 · 端到端(CTC / LAS / RNN-T)

Gen 2 是 ASR 从 hybrid pipeline 转向端到端建模的一次大拐弯。;生产系统里的降噪、VAD、热词、外挂 LM、rescore 仍常保留,存量电话客服 / IVR 也长期继续跑 Kaldi chain / hybrid 系统。引爆点是解决了「音频帧数远多于文本 token、训练集又没有逐帧对齐」的问题。

AI 音频小牛的博客 214

深度学习为什么需要反向传播

本文解析深度学习中的反向传播机制,说明其为何是模型训练的关键环节。前向传播完成预测并计算损失,但仅凭损失值无法指导数百万参数的调整。反向传播通过链式法则,将输出误差沿计算路径反向传播,为每个参数生成梯度,指明更新方向与幅度。文章从单权重模型出发,逐步扩展到多层网络,解释梯度下降与优化器的协作关系,并剖析PyTorch中loss.backward()的实际运作流程。反向传播使模型能够将整体误差精准分配到各层参数,实现高效学习,是连接"识别错误"与"修正错误"的核心桥梁。

Michael_Jay的博客 356

卷积神经网络 CNN 是什么?为什么适合处理图像?

你上次训练模型,调了半天正则化参数,过拟合终于压下去了。 然后产品经理跑过来问你:能不能加个功能,让模型自动识别用户上传的图片里有没有猫?

404 Not Found 406

深度学习数值稳定全解|Xavier/He初始化+梯度裁剪+AMP混合精度,根治梯度消失/爆炸/NaN

训练深层CNN、时序RNN、大Transformer时,频繁出现loss震荡、梯度NaN、收敛极慢,90%根源是数值稳定性失控。本文基于Glorot/He/Mixed Precision三篇顶会论文完整推导数学逻辑;区分CNN/RNN/LLM三大架构专属初始化方案;梳理梯度裁剪两种实现时序致命坑;配套可复现梯度监控完整PyTorch工程代码;提炼「初始化打底+梯度约束+AMP提速」三层工业训练流水线;

分享日常学习生活 449

循环神经网络二:序列到序列模型与机器翻译基础

循环神经网络二:序列到序列模型与机器翻译基础

root_123456_的博客 518

循环神经网络一:RNN、LSTM 与 GRU 的序列建模原理

循环神经网络一:RNN、LSTM 与 GRU 的序列建模原理

root_123456_的博客 596
上一篇: MegEngine 使用小技巧:Profiler 使用手册
下一篇: MegEngine 9-10 双月报:新版本发布,AI 生态升级,不容错过!
MegEngine_Bot
博客等级 码龄3年 169粉丝 · 19原创
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值