开发者从零后训练 Yandex 80B 模型:首轮 SFT 欠拟合的踩坑复盘

jjusko20 · reddit · 2026-10-05

Reddit 用户 jjusko20 汇报对 Yandex 开源的 AliceAI-80B-A3B-Base 做 instruct 后训练的第 4 次进展,目标是具备 agentic 工作与对话能力,并用 Qwen 3.8 27B 做浅层蒸馏来教链式推理。

进展与问题:

下一步与工具:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →