Medical model: Reasoning-Medical-27B (Qwen3.6-27B finetune)

Reddit r/LocalLLaMA Models

Summary

Reasoning-Medical-27B is a fine-tuned Qwen3.6-27B model for advanced medical reasoning, trained on 370k Q&A examples with Chain-of-Thought reasoning using GRPO and Unsloth optimization.

From the description: "Reasoning-Medical-27B is designed for universal advanced medical reasoning in professional medicine, medical genetics, college biology/medicine, and clinical knowledge. The model was fine-tuned on a large-scale dataset of 370,000 high-quality question-and-answer examples, incorporating Chain-of-Thought reasoning to improve step-by-step medical related questions. Training was performed using the GRPO trainer with the Unsloth optimization method for efficient fine-tuning." Model: https://huggingface.co/EpistemeAI/Reasoning-Medical-27B Demo: https://huggingface.co/spaces/EpistemeAI/reasoning-medical-27b
Original Article

Similar Articles