文章目录
- 一、微调数据集格式
- 二、常用的指令监督微调模板
-
* 2.1 指令跟随格式(Alpaca)- 2.2 多轮对话格式(ShareGPT)
- 2.3 其他形式
- 2.4 常见模板
- 参考资料
一、微调数据集格式
在进行大模型微调的过程中,我们会发现“Prompt”格式太多。不同的模型对应不同的微调数据集,不同数据集的指令数据形式有所不同。
-
yahma / alpaca-cleaned :这是斯坦福大学发布的原始 alpaca 数据集的清理版本,包含有约52K条数据。数据集主页:https://huggingface.co/datasets/yahma/alpaca-cleaned

-
Open-Orca / OpenOrca

二、常用的指令监督微调模板
指令监督微调(Instruct Tuning) 通过让模型学习详细的指令以及对应的回答来优化模型在特定指令下的表现。
目前常见微调数据集的格式包括以下几种:
- 指令跟随格式:以Alpaca为代表
- 多轮对话格式:以ShareGPT为代表

最低0.47元/天 解锁文章
1788

被折叠的 条评论
为什么被折叠?



