MiniMax H3 模型训练进展:Turbo Time LoRA 解决动作滞后
ostrisai · x · 2026-08-16
作者分享了正在训练的 MiniMax H3 模型在应用 Turbo Time LoRA 后的 4 步生成结果。通过这种技术手段,原本存在的动作生成滞后问题已被解决,现在的生成效果甚至出现了反向的趋势(动作过多/过快),表明模型在动态捕捉能力上有了显著变化。
「模型」频道最新
- dots3-note-prev模型发布:SWE-bench 78.4,主打本地运行 — victormustar · 2026-08-16
- llama.cpp 集成 Dots3 Note 模型,SWE-bench Verified 得分 78.4 — victormustar · 2026-08-16
- GLM-5.3 后训练展现惊人能力,参数量并非智力瓶颈 — haider1 · 2026-08-16
- 代码提交显示 Qwen 35B 模型已被移除或不会发布 — Local-Cardiologist-5 · 2026-08-16
- 多模型动漫女孩场景生成盲测结果 — Jeanodel · 2026-08-16
- 1bit量化让Qwen 27B在12GB显存跑出92 tokens/s — zyxciss · 2026-08-16