Cognition 发布 SWE-2 编码模型:对标 Fable 5.1,成本低 64%
simonguozirui · x · 2026-09-11
Cognition 官宣 SWE-2,称这是其在智能/成本比尺上的首次尝试:在 FrontierCode 基准上与 Fable 5.1 持平,成本却低 64%。技术关键是在训练中加入一种惩罚项,保持测试时扩展(test-time scaling)曲线的形状。SWE-2 也是 Cognition 首个支持 effort levels 的模型:单次 RL 训练即可推动整条 Pareto 曲线——medium 档变得更便宜且更聪明,max 档则学会用更多 token 和轮次换取最高分。团队还为此改进了长度惩罚(length penalty)配方,细节见其博客。
所属事件:Cognition 发布 SWE-2:比肩前沿模型,成本最高省 70%(11 条相关)→
「编程与Agent」频道最新
- Replit 上线 Routines 自动化功能,还支持设置预算 — amasad · 2026-09-11
- 把 Replit Agent 装进机器人:自主建站并一键发布 — amasad · 2026-09-11
- 开源 OmniGet 支持 1800+ 站点下载课程视频并转写整理 — tom_doerr · 2026-09-11
- 独立开发者用 Fable 造群聊应用:AI 自己加班加了两个'惊喜'功能 — RileyRalmuto · 2026-09-11
- 用Codex生成Remotion动效再喂给MiniMax H3出片 — Hailuo_AI · 2026-09-11
- Reddit 网友发问:为何没有面向 Agent 运行时而非模型的基准测试? — Balance- · 2026-09-11