SummFlow 2026-06-08 Hugging Face

tatsu-lab / alpaca

由OpenAI引擎生成的指令和示范数据集,用于指令微调

5.2万行 · 319 MB

  • 文本
  • 文本生成
  • cc-by-nc-4.0 · 非商用

下载 104k · 收藏 984 · 3年前更新

社区实测

早期有影响力的指令微调数据集,全量合成自 Self-Instruct,但因数据质量问题和底层模型许可限制,实际落地使用有限。

  • 提供了可复现的指令微调基线,52K 条合成数据即可让 7B 模型在 Self-Instruct 评测上接近 text-davinci-003
  • 以开源数据集+训练代码的形式降低了指令跟随研究的复现门槛
  • 数据存在明显的拼接/格式错误,部分样本中多条 instruction-response 被错误合并
  • 全量合成数据,生成依赖已弃用的 text-davinci-003,无法用原始方法复现或扩展
  • 基于 LLaMA 权重微调,衍生使用受 LLaMA 原始许可限制,商用需谨慎

截至 2026-06-20

  • py from datasets import load_dataset ds = load_dataset("tatsu-lab/alpaca")