FreedomIntelligence / medical-o1-reasoning-SFT
基于可验证医疗问题的推理链SFT数据集,来自Deepseek-R1蒸馏。
社区实测
HuatuoGPT-o1 的 SFT 训练数据集,由 GPT-4o 生成的带复杂思维链的医疗问答题,Apache 2.0 许可,社区主要将其用于医疗 LLM 推理能力微调。
- 医疗推理 SFT 训练数据开源,附带 GPT-4o 生成的复杂思维链(Complex CoT)与答案
- Apache 2.0 许可,允许商用
- 中英双语医疗问答覆盖(en/zh 各约 2 万条)
- 数据完全由 GPT-4o 合成生成,推理质量与医学准确性受限于生成模型,未经人工校验的合成数据可能包含幻觉或错误推理
截至 2026-06-20
- pyfrom datasets import load_dataset ds = load_dataset("FreedomIntelligence/medical-o1-reasoning-SFT")