书生·共学大模型实战营 第四期 L2-G300作业分享

从零开始:YOLOv8车牌检测模型训练全流程实战 本文详细介绍了从零开始训练YOLOv8车牌检测模型的全流程实战指南。内容涵盖环境搭建、数据集收集与标注、模型配置与训练、评估测试及高级优化技巧。通过使用预训练模型和迁移学习,开发者可以高效构建精准的车牌检测系统,并掌握模型导出与部署的关键步骤。 阅读详情

书生 ⋅ \cdot 共学大模型实战营第四期

本系列为InterLM 闯关作业个人完成情况分享
欢迎加入书生大模型实战训练营,赢取A100算力,丰富实战经验,完成实际项目,解锁更多可能!


Reference: https://github.com/syzonline/pjlearning/blob/camp4/docs/L1/Prompt/tasks.md
Affiliation: University of Science & Technology of China
Organization: Shanghai Artificial Intelligence Laboratory
Contact: zhangsy2023@mail.ustc.edu.cn

基础任务:优化prompt引导浦语大模型得出正确结果

任务描述:利用对提示词的精确设计,引导语言模型正确回答出“strawberry”中有几个字母“r”。


InternStudio的开发机内置了多个书生系列大模型,因此本实验建议采用开发机完成。首先在开发机上创建名为prompt_demo的环境,下载相关依赖:

# 安装一些必要的库
conda install pytorch==2.1.2 torchvision==0.16.2 torchaudio==2.1.2 pytorch-cuda=12.1 -c pytorch -c nvidia -y

# 安装其他依赖
pip install transformers==4.43.3

pip install streamlit==1.37.0
pip install huggingface_hub==0.24.3
pip install openai==1.37.1
pip install lmdeploy==0.5.2

(这里可参考第三期的文档https://github.com/InternLM/Tutorial/tree/camp3/docs/L1/Prompt)
使用VSCode连接开发机后,先开启终端1,在该终端中通过LMDeploy对模型进行部署:

CUDA_VISIBLE_DEVICES=0 lmdeploy serve api_server /share/new_models/Shanghai_AI_Laboratory/internlm2-chat-1_8b --server-port 23333 --api-keys internlm2

后面采用终端2,使用Tutorial项目中的脚本创建图形化页面(通过streamlit):

git clone https://github.com/InternLM/Tutorial.git
cd Tutorial/tools
python -m streamlit run chat_ui.py

在VSCode中,会自动设置端口转发,将远程端口0.0.0.0:23333转发到本地端口localhost:23333:
在这里插入图片描述
此时,我们在浏览器中打开localhost:23333,可以看到经过streamlit渲染的书生大模型UI界面。
我们发现,直接询问模型"strawberry"中包含几个字母"r",它会给出错误的答案1,这里,采用的策略是,引导模型将整个任务拆解,分别考虑前半段的"straw"和后半段的"berry"含有几个目标字符,正确的答案是两段相加得到的结果。
在这里插入图片描述

Ubuntu AI开发环境搭建:从深度学习大模型应用的完整实践 Ubuntu AI开发环境搭建摘要 本文详细介绍了在Ubuntu系统上配置完整AI开发环境的流程。主要内容包括: 硬件准备:推荐使用NVIDIA GPU(显存16GB+)、32GB内存和1TB NVMe SSD 驱动安装:详细说明NVIDIA驱动、CUDA 12.x和cuDNN的安装配置方法 深度学习框架:提供PyTorch和TensorFlow的安装指南,包括conda和pip两种方式 性能优化:介绍多GPU配置、NVLink设置以及PyTorch 2.0+的编译优化技术 该环境支持从基础深度学习大模型 阅读详情

相关推荐

出现 Connection Failed [MySQL][ODBC Driver]Access denied for user ‘root‘@x(using password:YES)解决方法

Connection Failed [MySQL][ODBC 8.0(w) Driver]Access denied for user 'root'@xxxx (using password:YES)

码农研究僧的博客 1019

人工智能、机器学习和深度学习到底是什么关系?

人工智能(AI)、机器学习(ML)和深度学习(DL)是三个层级嵌套的概念:DL⊂ML⊂AI。AI是最广泛的研究领域,关注机器完成智能任务的能力;ML是实现AI的一类方法,通过数据训练模型;DL则是ML的一个分支,使用多层神经网络自动学习特征表示。 具体区别体现在: AI包含规则系统和数据驱动方法,ML专注于从数据中学习规律 传统ML依赖人工特征工程,DL能自动提取多层次特征 DL在图像/语音/文本等非结构化数据上表现突出,但需要更多数据和算力 项目选择应基于任务特性:规则明确用编程,结构化小数据用传统ML(

Michael_Jay的博客 336

RAISECOM S5600系列命令行手册

ISCOM S5600-EI(A)系列 三层以太网交换机配置指南CLI

RNNoise:极小体积的实时降噪 baseline

RNNoise 是小模型也能做实用降噪的经典证明 —— 用 30 年 DSP 沉淀(Bark scale / BFCC / pitch analysis / comb filter)打底 · 只用 GRU 学最难手工调的那部分(每帧 22 个 band 该给多少 gain)· 换来 100 KB 的编译体积和 10 ms 延迟。这是端侧 real-time 场景(视频会议 · 通话 · WebRTC · Discord noise gate · 麦克风驱动层)至今仍常见的默认选择。

AI 音频小牛的博客 253

循环神经网络 RNN、LSTM、GRU 是什么?为什么能处理序列?

上篇我们聊完CNN,看它怎么像放大镜一样,逐块扫图像、提取特征。 但有一类数据,CNN处理起来很吃力——什么数据呢? 有时间顺序的数据。 你跟 Siri 说的那句"嘿,明天早上七点叫我起床"——这串声音信号得按顺序听完,才能理解意思。

404 Not Found 546

深度学习到底是什么?它和机器学习有什么区别?

你有没有想过,为什么现在解锁手机只要看一眼、翻译外语拍张照就能出结果、下棋甚至能赢过世界冠军? 这些事情听起来像科幻,但背后靠的是同一个技术——深度学习

404 Not Found 1557

AI与深度学习:从原理到应用

深度学习是人工智能领域过去十年最激动人心的突破。从识别一张图片中的猫,到与人类进行流畅对话,再到辅助医生拯救生命,深度学习正在不断拓展机器能力的边界。它不是魔法,而是数学、算法和数据的精妙结合。理解深度学习的基本原理,不仅能帮助我们更好地使用这些工具,也能让我们在这个AI驱动的时代中,做出更明智的判断和选择。未来已来,而深度学习正是那扇通往未来的大门。

m0_73407070的博客 445

卷积神经网络一:CNN 核心 —— 卷积、池化与特征提取

卷积神经网络一:CNN 核心 —— 卷积、池化与特征提取

root_123456_的博客 272

深度学习基础-Harness:从评估框架到工程落地

深度学习工程语境中,Harness 通常指一套模型评测与验证框架。它的核心目标是把「训练好的模型到底好不好」这件事从主观感受变成可重复、可量化的工程流程。统一的数据集加载接口,屏蔽不同数据来源的差异;标准化的推理流程,支持批量评测与单条调试;可扩展的评估指标,如准确率、困惑度、ROUGE、F1 等;结果记录与对比机制,便于多轮实验追踪。理解 Harness 之前,需要先回到它的上游基础:深度学习模型是如何被训练、推理和评估的。Harness 并不是某个特定框架的专属名称,而是一种。

2501_94116301的博客 310

【超详细】CREPE 与 SPICE:深度学习基频检测的原理、架构与实践

摘要 本文系统介绍了基于深度学习的基频检测方法,重点分析了CREPE和SPICE两种模型。传统方法依赖手工特征设计,难以应对真实音频的多样性。CREPE通过卷积神经网络将基频检测转化为分类问题,采用六层一维卷积架构和概率分布输出,实现了高精度估计。SPICE则在保持性能的前提下,通过深度可分离卷积等技术大幅降低计算量,适合移动端部署。文章详细阐述了模型架构、训练策略(如数据增强和标签软化)及实际部署方案,展现了深度学习在基频检测领域的优势与潜力。

民乐团扒谱机的博客 496

深度学习 & PyTorch笔记

深度学习基础概念、梯度下降原理 → PyTorch 框架、张量科学计算 → 网络组件、三种模型搭建方式**完整串联;同时对比传统 sklearn,厘清同义术语,配套可运行代码示例,打通理论和编程实践。

190

基于贝叶斯优化的BiLSTM(BO-BiLSTM)一维时间序列预测算法matlab仿真

本文提出了一种基于贝叶斯优化(BO)和双向长短期记忆网络(BiLSTM)组合的时间序列预测方法BO-BiLSTM。该方法通过贝叶斯优化自动搜索BiLSTM的关键超参数(如学习率、神经元数量、窗口长度等),以提升模型预测精度。文章详细阐述了BiLSTM原理、贝叶斯优化的高斯过程代理模型和采集函数机制,并给出了完整的实现步骤:包括数据预处理、超参数空间定义、目标函数构建、贝叶斯优化迭代等流程。实验结果表明,该方法能有效降低预测误差,附带的MATLAB程序工程展示了训练集/测试集的预测效果对比图和误差分析图。该集

MATLAB,verilog,python,opencv,tensorflow,caffe,C,C++ 227

【免费】基于YOLO26的车辆车牌识别系统(深度学习+LPRNet+CCPD+PyQt6) 人工智能 机器视觉 计算机视觉 锋哥原创出品,必属精品

本文介绍了一个基于YOLO26的车辆车牌识别系统,该系统采用深度学习技术实现车牌自动识别。系统主要由车牌检测(YOLO26-Pose)和字符识别(LPRNet)两阶段组成,支持处理倾斜、双层车牌,并能区分蓝牌、绿牌和黄牌。系统采用Python3.11开发,PyQt6构建图形界面,包含图片/视频/摄像头识别、历史记录查询等功能,数据存储在MySQL数据库中。测试表明系统能有效识别多种车牌类型,适合停车场管理等场景应用。项目完整源码已提供下载链接。

java1234的博客 799

AI基础系列(3)| NumPy / Pandas / PyTorch 理论知识入门:数据科学与深度学习的三大基石

本文系统梳理了NumPy、Pandas和PyTorch三大Python库的核心理论,为企业AI转型提供技术支撑。NumPy的ndarray、向量化运算和广播机制构成数值计算基础;Pandas通过索引对齐和分组聚合处理结构化数据;PyTorch的动态计算图实现自动微分与GPU加速。三者相互补充,形成完整AI技术栈。文章强调理解底层原理的重要性,建议从业者从基础数组操作逐步深入至神经网络构建,并针对常见问题提供解决方案。随着AI技术普及,掌握这些核心库的底层理论将成为开发高效可靠AI系统的关键。

CIO_Alliance的博客 203

【第8篇】OverLock(CVPR2025):新型卷积神经网络OverLoCK,通用的即插即用Backbone!

本文介绍 CVPR 2025 纯卷积视觉网络 OverLoCK。模型提出 Deep-stage Decomposition Strategy(深度阶段分解策略,DDS)与 Context-Mixing Dynamic Convolution(上下文混合动态卷积,ContMix),分别解决“高层语义如何反向指导特征提取”和“卷积如何兼顾长程依赖与局部归纳偏置”两个问题。

weixin_38647644的博客 175

ASR 五代演进(三):Gen 2 · 端到端(CTC / LAS / RNN-T)

Gen 2 是 ASR 从 hybrid pipeline 转向端到端建模的一次大拐弯。;生产系统里的降噪、VAD、热词、外挂 LM、rescore 仍常保留,存量电话客服 / IVR 也长期继续跑 Kaldi chain / hybrid 系统。引爆点是解决了「音频帧数远多于文本 token、训练集又没有逐帧对齐」的问题。

AI 音频小牛的博客 220

深度学习为什么需要反向传播

本文解析深度学习中的反向传播机制,说明其为何是模型训练的关键环节。前向传播完成预测并计算损失,但仅凭损失值无法指导数百万参数的调整。反向传播通过链式法则,将输出误差沿计算路径反向传播,为每个参数生成梯度,指明更新方向与幅度。文章从单权重模型出发,逐步扩展到多层网络,解释梯度下降与优化器的协作关系,并剖析PyTorch中loss.backward()的实际运作流程。反向传播使模型能够将整体误差精准分配到各层参数,实现高效学习,是连接"识别错误"与"修正错误"的核心桥梁。

Michael_Jay的博客 358

卷积神经网络 CNN 是什么?为什么适合处理图像?

你上次训练模型,调了半天正则化参数,过拟合终于压下去了。 然后产品经理跑过来问你:能不能加个功能,让模型自动识别用户上传的图片里有没有猫?

404 Not Found 421

深度学习数值稳定全解|Xavier/He初始化+梯度裁剪+AMP混合精度,根治梯度消失/爆炸/NaN

训练深层CNN、时序RNN、大Transformer时,频繁出现loss震荡、梯度NaN、收敛极慢,90%根源是数值稳定性失控。本文基于Glorot/He/Mixed Precision三篇顶会论文完整推导数学逻辑;区分CNN/RNN/LLM三大架构专属初始化方案;梳理梯度裁剪两种实现时序致命坑;配套可复现梯度监控完整PyTorch工程代码;提炼「初始化打底+梯度约束+AMP提速」三层工业训练流水线;

分享日常学习生活 452

循环神经网络二:序列到序列模型与机器翻译基础

循环神经网络二:序列到序列模型与机器翻译基础

root_123456_的博客 537

循环神经网络一:RNN、LSTM 与 GRU 的序列建模原理

循环神经网络一:RNN、LSTM 与 GRU 的序列建模原理

root_123456_的博客 602
上一篇: 书生 共学 大模型实战训练营第四期 L0-G400 Huggingface基础知识
离异带俩娃求好心富婆收养
博客等级 码龄8年 44粉丝 · 4原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值