tatsu-lab / alpaca
由OpenAI引擎生成的指令和演示数据集
社区实测
早期有影响力的指令微调数据集,全量合成自 Self-Instruct,但因数据质量问题和底层模型许可限制,实际落地使用有限。
- 提供了可复现的指令微调基线,52K 条合成数据即可让 7B 模型在 Self-Instruct 评测上接近 text-davinci-003
- 以开源数据集+训练代码的形式降低了指令跟随研究的复现门槛
- 数据存在明显的拼接/格式错误,部分样本中多条 instruction-response 被错误合并
- 全量合成数据,生成依赖已弃用的 text-davinci-003,无法用原始方法复现或扩展
- 基于 LLaMA 权重微调,衍生使用受 LLaMA 原始许可限制,商用需谨慎
截至 2026-06-20
- pyfrom datasets import load_dataset ds = load_dataset("tatsu-lab/alpaca")