TEMPO 训练法:模型在 ARC-AGI-3 上显著超越基准线

CodeByPoonam · x · 2026-08-31

TEMPO 方法在 ARC-AGI-3 基准上表现出色,得分比基线高 31.5%,比标准强化学习 (GRPO) 高 20.6%。在长轮次交互中,该方法能持续提升性能,而基线模型则陷入停滞。

所属事件:TEMPO 训练法大幅刷新 ARC-AGI-3 成绩(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →