网友用 3 张 V100 自训 80B 模型:SFT 加 GRPO 后训练实践

jjusko20 · reddit · 2026-09-25

作者分享自己 post-train 开源模型 AliceAI-Foundation-80B-A3B-Base 的进行中项目:

SFT 数据生成框架已搭好,尚无最终结果,属于社区自训前沿开源模型的实践记录。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →