无需编程,轻松训练AI大模型:0代码微调秘籍

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

介绍一种简单的方式微调训练AI大语言模型,全程不用代码,非技术人员也可轻松上手,非常适合小白体验微调的魔力,大神可跳过~

什么是微调(Fine-tuning)?

Fine-tuing 通过对大模型增加一些特定数据让其表现的更好,控制大模型的第二手段,第一手段是提示工程。

Fine-tuning能解决哪些问题?

  1. 1. 提升模型在特定任务上的表现

  2. 2. 提升模型的响应速度

  3. 3. 抑制模型幻觉

  4. 4. 提示对复杂指令的遵循,减少workflow节点(原来三个简单prompt任务节点,可以合并成一个复杂任务prompt)

  5. 5. 使用微调后的小模型替代参数更大的模型

准备

  1. 注册阿里云百炼大模型平台:https://bailian.console.aliyun.com/ ,支付宝或淘宝账号即可注册。

  2. 至少40条高质量训练数据。高质量:输入是指令清晰的提示词,输出的答案是正确的。

两种数据格式选其一:

• csv表格

  • • json
{"messages": [{"role": "system", "content": "You are a helpful assistant"}, {"role": "user", "content": "谁在文艺复兴时期绘制人体?"}, {"role": "assistant", "content": "文艺复兴时期是一个关于艺术、文化和学术的复兴运动,在这个时期,许多艺术家都绘制了人体。"}]}   {"messages": [{"role": "system", "content": "You are a helpful assistant"}, {"role": "user", "content": "谁在文艺复兴时期绘制人体?"}, {"role": "assistant", "content": "文艺复兴时期是一个关于艺术、文化和学术的复兴运动,在这个时期,许多艺术家都绘制了人体。"}]}

注:表格中prompt、json中system是提示词,例子中是比较简单的,如果你想让模型执行多种任务,提示词应该包含:角色、步骤或规则,这样才能让模型学习到做不同的任务。

开始

首先打开阿里云百练平台

一、上传训练数据

1.数据应用 → 模型数据 → 新增数据集

  1. 1. 新增数据集

  • • 数据集名称:随便写

  • • 数据集类型:选择 训练集- SFT - 文本生成

  • • 数据导入:下载模板→按照格式要求填入文章开头准备的训练数据→上传 。

  • • 点击确认

2.发布数据集,上传数据后一定要来点【发布】

二、模型训练

1.模型工具 → 模型调优 → 训练新模型

2.创建训练任务

  • 训练方式:直接选择SFT

  • SFT(supervised fine-tuning ):目的是通过针对性的数据集和训练,提升模型在特定场景/业务中的表现,适合基于大量数据为您的应用进行模型定制,训练数据集数据只提供正样本。

  • DPO(Direct Preference Optimization):训练数据集数据同时提供正负样本,目的是引入负反馈,降低幻觉,使得模型输出对齐人类的价值观或偏好,适合基于用户反馈,在应用上线后快速迭代优化模型表现

  • • **选择模型:**推荐qwen 2.5系列,这个系列是阿里千问团队最新开源模型,参数量根据自己对于推理能力的要求选择,参数量越大智力越高,这里我选择qwen 2.5-14b,14b表示140亿的参数量。

  • 训练方式:

  • • 高效训练(lora):只更新模型的部分参数,训练算力要求低,训练耗时更短。

  • • 全参数:更新模型的全部参数,训练算力要求更高,训练耗时更长。

  • • 我一般先选择lora,如果效果不行,再使用全参数训练,在百炼平台上两者费用是一样的。

  • • 选择训练数据:选择之前上传的数据集

  • • 选择验证数据

  • • 自动切分:自动切分20%的训练数据作为验证数据,我的经验如果准备的数据在几百条以上那么选择自动切分,如果100条以内的选择验证集 ,直接使用训练数据集,虽然这样会让结果过拟合训练数据,没法评测出泛化处理,但尽量保证训练数据量,在chat界面体验下微调的效果

  • • 混合训练:以你的训练数据为基础,按比例加上其他类型数据,初次尝试可以不设置。

  • • 超参数配置:直接使用默认值,如果训练数据小于100条,建议将循环次数改为5。其它参数忽略。如果你对参数的含义兴趣,见文章底部附录。

接下来就可以开始训练了

3.训练成功后,进入部署模型页

三、模型部署

1.模型工具 → 模型部署 → 部署新模型

2.部署模型,部署过程需要10几分钟,注意:部署模型时消耗的算力是按小时算的,7b或14b的模型需要2个算力单元,40块一小时,越大的模型需要额算力越多

部署成功后,就可以体验效果啦

四、体验模型

页面路径:模型体验 → 文本模型 → 文本调试tab

  • • 设置好system 后 ,输入内容,点击 执行 即可看到效果

  • • temperature:创意任务值调大,精确任务调小

结语

  1. 1. 微调训练的关键是数据,数据越多越好

  2. 2. 如缺乏数据,通过提示词+Claude或ChatGPT高级大模型生成

  3. 3. 支持界面微调大模型平台的除了阿里云百炼,还有:智谱AI开放平台、百度云平台、硅基流动

零基础如何学习AI大模型

领取方式在文末

为什么要学习大模型?

学习大模型课程的重要性在于它能够极大地促进个人在人工智能领域的专业发展。大模型技术,如自然语言处理和图像识别,正在推动着人工智能的新发展阶段。通过学习大模型课程,可以掌握设计和实现基于大模型的应用系统所需的基本原理和技术,从而提升自己在数据处理、分析和决策制定方面的能力。此外,大模型技术在多个行业中的应用日益增加,掌握这一技术将有助于提高就业竞争力,并为未来的创新创业提供坚实的基础。

大模型典型应用场景

AI+教育:智能教学助手和自动评分系统使个性化教育成为可能。通过AI分析学生的学习数据,提供量身定制的学习方案,提高学习效果。
AI+医疗:智能诊断系统和个性化医疗方案让医疗服务更加精准高效。AI可以分析医学影像,辅助医生进行早期诊断,同时根据患者数据制定个性化治疗方案。
AI+金融:智能投顾和风险管理系统帮助投资者做出更明智的决策,并实时监控金融市场,识别潜在风险。
AI+制造:智能制造和自动化工厂提高了生产效率和质量。通过AI技术,工厂可以实现设备预测性维护,减少停机时间。

这些案例表明,学习大模型课程不仅能够提升个人技能,还能为企业带来实际效益,推动行业创新发展。

学习资料领取

如果你对大模型感兴趣,可以看看我整合并且整理成了一份AI大模型资料包,需要的小伙伴文末免费领取哦,无偿分享!!!
vx扫描下方二维码即可
加上后会一个个给大家发

在这里插入图片描述

部分资料展示

一、 AI大模型学习路线图

整个学习分为7个阶段
在这里插入图片描述
请添加图片描述

二、AI大模型实战案例

涵盖AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,皆可用。
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述

三、视频和书籍PDF合集

从入门到进阶这里都有,跟着老师学习事半功倍。
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述

四、LLM面试题

在这里插入图片描述
在这里插入图片描述

五、AI产品经理面试题

在这里插入图片描述

😝朋友们如果有需要的话,可以V扫描下方二维码联系领取~
在这里插入图片描述

👉[CSDN大礼包🎁:全网最全《LLM大模型入门+进阶学习资源包》免费分享(安全链接,放心点击)]👈

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值