note
- 在《Aligning Large Language Models with Human: A Survey》综述中对LLM数据分类为典型的人工标注数据、self-instruct数据集等
- 优秀的开源sft数据集:alpaca_data、belle、千言数据集、firefly、moss-003-sft-data多轮对话数据集等
文章目录
构造指令实例的3种方式

图源自人大的LLM综述《A Survey of Large Language Models》
- 格式化任务数据集
- 格式化日常对话数据集
- 格式化合成数据集:self-instruct就是这种方式, 初始只需100多个实例作为任务池
sft:Aligning Large Language Models with Human: A Survey
这篇工作【地址:arxiv.org/abs/2307.12966】对LLM的sft数据进行分类:
- 人工标注数据
- self-Instruct

Alpaca
链接:https://github.com/tatsu-lab/stanford_alpaca
[stanford_alpaca] 使用 self in
订阅专栏 解锁全文
3466

被折叠的 条评论
为什么被折叠?



