FreedomIntelligence / medical-o1-reasoning-SFT
基于医疗可验证问题的推理链SFT数据,蒸馏自Deepseek-R1。
仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。
项目资料与外部反馈
该数据集的问题来自可验证医学问题,但推理链与答案全部由 GPT-4o 合成生成,未经人工标注,采用时需评估合成数据的可靠性
- 医学推理思维链 SFT 微调,为 HuatuoGPT-o1 等模型提供训练数据
- 该数据集的问题来自可验证医学问题,但推理链(Complex CoT)与输出(Response)全部由 GPT-4o 生成,属于合成数据,未经人工医学专家标注验证
来源
GitHub - FreedomIntelligence/HuatuoGPT-o1: Medical o1, Towards medical complex reasoning with LLMs · GitHubFine-Tuning DeepSeek R1 Reasoning on Medical Chain ...FreedomIntelligence/medical-o1-reasoning-SFT · Datasets ...
截至 2026-07-22