Reasoning-Medical-27B 用 37 万医学问答微调 Qwen3.6-27B
beneath_steel_sky · reddit · 2026-07-28
Reasoning-Medical-27B 是一个基于 Qwen3.6-27B 的医学推理微调模型
帖子介绍了 Reasoning-Medical-27B,定位是覆盖专业医学、医学遗传学、大学生物/医学和临床知识的通用医学推理模型。
训练信息
- 基座模型:Qwen3.6-27B
- 训练数据:37 万条高质量问答样本
- 训练方式:加入 Chain-of-Thought 推理,提升逐步解题能力
- 训练器:GRPO trainer
- 优化方法:Unsloth
发布内容
帖子给出了 Hugging Face 模型页和 Demo Space 链接,说明这个项目已经公开可试用。当前可确认的信息主要是训练设定和发布形态,尚未提供更完整的端到端评测。
「研究」频道最新
- OpenAI 招聘变革性 AI 经济学主管,MATS 奖学金开放申请 — Astral Codex Ten · 2026-08-24
- AI 科学家有了新标尺:从“考试”转向真实发现闭环 — 量子位 · 2026-08-24
- AI 协助证明埃尔德什猜想超越性 — inductionheads · 2026-08-24
- Stanford 新法:LLM 自我验证,分数暴涨 9.3% — Saboo_Shubham_ · 2026-08-24
- 异构量子架构论文:容错计算物理量子比特需求降 138 倍 — MJBiercuk · 2026-08-24
- InfinityEdit:无限视频编辑,仅靠轻量级适配器实现 — Yunze Tong · 2026-08-24