医疗模型:Reasoning-Medical-27B (Qwen3.6-27B微调)

Reddit r/LocalLLaMA 模型

摘要

Reasoning-Medical-27B 是一个基于 Qwen3.6-27B 微调的高级医学推理模型,使用 GRPO 和 Unsloth 优化方法,在 37 万个问答示例上通过思维链推理进行训练。

来自描述:“Reasoning-Medical-27B 专为专业医学、医学遗传学、大学生物/医学及临床知识中的通用高级医学推理而设计。该模型在包含 37 万高质量问答示例的大规模数据集上进行了微调,融合了思维链推理以改进医学相关问题的逐步解答。训练使用 GRPO 训练器配合 Unsloth 优化方法以实现高效微调。” 模型:https://huggingface.co/EpistemeAI/Reasoning-Medical-27B 演示:https://huggingface.co/spaces/EpistemeAI/reasoning-medical-27b
查看原文

相似文章