Cognition SWE-2 登顶 Terminal-Bench 2.1,得分 92.8
cdnsteve · hn · 2026-09-11
据 HN 帖子引用的消息,Cognition 的 SWE-2 模型在 Terminal-Bench 2.1 上取得 92.8 分,排名居前。链接指向 tokenstead.ai 的模型页,原帖未展开更多细节。
「模型」频道最新
- 实测各 LLM 订阅真实代币价值:Grok Heavy 40 倍 ROI 最高 — thesaraharminta · 2026-09-11
- AI 研究者观察:纳维-斯托克斯突破后,怀疑派也开始相信 AGI 已至 — cloneofsimo · 2026-09-11
- 用户抱怨 gpt-6-astra 聪明又离谱,回退旧模型搭配使用 — rudrank · 2026-09-11
- GPT Pro 用户困惑:Codex 5.3 Spark 为何单独计量用量 — takshit2 · 2026-09-11
- 256k 上下文用到 80% 和 1M 用到 80% 效果一样吗 — BriefServe453 · 2026-09-11
- Pro 用户连续 4 天 90% 时间无法用 Codex,客服只有机器人 — Effective-System-727 · 2026-09-11