Cognition 发布 SWE-2:首个支持 effort 档位的模型,单次 RL 推高 Pareto 曲线

andrew_n_carr · x · 2026-09-11

Cognition 发布编码模型 SWE-2,是其首个支持 effort 档位(effort levels)的模型。为此团队对长度惩罚(length penalty)方案做了重大改进。

核心结果:在单次 RL 训练中即可推高 Pareto 曲线并保持其形状——medium effort 档同时变得更便宜且更聪明;max effort 档则学会使用更多 token 和轮次,以换取最高分数。社区(如 andrewncarr)对配套图表反响热烈。

所属事件:Cognition 发布 SWE-2 并融资 20 亿美元(5 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →