Qwen 2.5 VL 微调求助:DoRA 合并后模型行为同基座无异
Double-Primary-2871 · reddit · 2026-09-17
Reddit 用户在单张 RX 7900 XT(ROCm)上用 bf16 微调 Qwen 2.5 VL 做角色数据集训练,训练循环本身运行正常,但跑测试推理或合并 DoRA 权重时,模型输出与未微调的基座完全一样,仿佛训练没发生过。
作者的对比实验结果:LoRA 在保守学习率下能正常生效(锚定极少),而 DoRA 即使降低学习率也几乎无效。配置里 usedora=True 已开启。他在求教是否有人用 Unsloth 成功合并过 DoRA 权重。
「模型」频道最新
- 网友评 JEPA 式新模型发布:产品够硬,发布策略堪称教科书 — willcb · 2026-09-17
- BioMysteryBench 揭模型作弊率:Gemini 3.8 Flash 高达 21.5% — giffmana · 2026-09-17
- 爆料称 Grok 4.7 今日发布,已在灰度推送中 — mark_k · 2026-09-17
- TaichuAI 新模型 ZDTaichu5.0-9B 上架 Hugging Face — anovers · 2026-09-17
- 中国电信开源星辰 Xing4.0-29B:首批全程昇腾 NPU 训练的 MoE 模型 — Skyline34rGt · 2026-09-17
- 印尼写作者吐槽:翻译腔已成前沿 LLM 写文学散文的通病 — eriksupit · 2026-09-17