单台 DGX Spark 微调 MedGemma:4B 肿瘤任务从 56% 升至 71.6%

Few-Rough-2215 · reddit · 2026-10-06

一位开发者仅用一台 DGX Spark,用 LoRA/QLoRA 在肿瘤学任务上微调 MedGemma 4B 与 27B,公开数据、5 个数据集 9 项任务、2199 题冻结测试集、配对 McNemar 检验:

更重要的发现:作者疑似在 Unsloth 下 LoRA scale 存在偏差——名义 alpha=16 合并适配器后性能大部分丢失,用 alpha=32(约 2 倍)合并则正常;身份探针与有效 scale≈2×alpha/r 一致。作者已放探针脚本求独立复现。另外 bf16 舍入会在合并时抹掉 17-37% 的 delta 元素,逐字记忆内容(如训过的誓词)无法保留。

模型、测试集与报告(含 DOI)均已开源,作者声明仅供研究、非医疗器械。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →