SummFlow 2026-06-07 Hugging Face

FreedomIntelligence / medical-o1-reasoning-SFT

基于医疗问题的推理链监督微调数据集

9.0万行 · 680 MB

  • 文本
  • 问答
  • 文本生成
  • apache-2.0 · 可商用
  • 含中文

下载 6.9k · 收藏 1.1k · 1年前更新

社区实测

HuatuoGPT-o1 的 SFT 训练数据集,由 GPT-4o 生成的带复杂思维链的医疗问答题,Apache 2.0 许可,社区主要将其用于医疗 LLM 推理能力微调。

  • 医疗推理 SFT 训练数据开源,附带 GPT-4o 生成的复杂思维链(Complex CoT)与答案
  • Apache 2.0 许可,允许商用
  • 中英双语医疗问答覆盖(en/zh 各约 2 万条)
  • 数据完全由 GPT-4o 合成生成,推理质量与医学准确性受限于生成模型,未经人工校验的合成数据可能包含幻觉或错误推理

截至 2026-06-20

  • py from datasets import load_dataset ds = load_dataset("FreedomIntelligence/medical-o1-reasoning-SFT")