Cognition 发布 SWE-2:首个支持 effort 档位的模型,单次 RL 推高 Pareto 曲线
andrew_n_carr · x · 2026-09-11
Cognition 发布编码模型 SWE-2,是其首个支持 effort 档位(effort levels)的模型。为此团队对长度惩罚(length penalty)方案做了重大改进。
核心结果:在单次 RL 训练中即可推高 Pareto 曲线并保持其形状——medium effort 档同时变得更便宜且更聪明;max effort 档则学会使用更多 token 和轮次,以换取最高分数。社区(如 andrewncarr)对配套图表反响热烈。
所属事件:Cognition 发布 SWE-2 并融资 20 亿美元(5 条相关)→
「编程与Agent」频道最新
- 腾讯开源 RAG 平台 WeKnora:GitHub 星数 22k,文档秒变推理知识库 — abhishek__AI · 2026-09-11
- 腾讯开源 RAG 平台 WeKnora:文档转知识库,带知识图谱与自主智能体 — abhishek__AI · 2026-09-11
- 用同一 Pokédex 实测 GPT-6 Astra 与 DeepSeek:四种组合,结论是别乱加戏 — kevinkern · 2026-09-11
- Agent Arena 发布:用数百万真实长程任务为模型排座次 — arena · 2026-09-11
- 开源 MCP 服务器 mcp-ecc:统一管理五大邮件与日历服务商 — karljsamuel · 2026-09-11
- GPT-6 Astra 带火 Codex 用量,开发者连发三个 Obsidian AI 插件 — vista8 · 2026-09-11