提交时间暴露后训练差异:GLM 5.3、Kimi K3 等开源模型超 10 小时才交卷

nrehiew_ · x · 2026-09-03

通过分析模型在长程任务中的提交时间线,作者推断各家模型长程后训练的多少:Sol 和 Fable 提交较早,其中 Fable 持续工作的时间明显更长;而多数开源模型包括 GLM 5.3、Kimi K3 和 Qwen 3.8 Max 提交极晚(超过 10 小时),说明它们对时间与预算概念把握较差。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →