Code Arena 一周年:榜首得分涨 340 分,GPT-6 Astra 以 1796 分领跑
arena · x · 2026-09-13
Code Arena: WebDev 榜单发布年度回顾:过去一年榜首模型得分上涨 +340 分,竞争头名的顶级实验室从 6 家扩至 10 家。Anthropic 全年多数时间占据榜首,但开源模型 Kimi K3(Moonshot,7 月发布)曾登顶。目前 OpenAI 的 GPT-6 Astra 以 1796 分居首,Claude Fable 5.1 以 1764 分紧随,第三名 Alibaba Qwen 为 1685 分,落后 103 分。该榜单基于用户在真实前端开发任务上的双盲偏好投票排名。
所属事件:Code Arena 一周年:榜首得分大涨 340 分,GPT-6 Astra 以 1796 分领跑(2 条相关)→
「模型」频道最新
- Fireworks 上现神秘「Kimi Pluto v1」模型卡,月之暗面新模型? — Severe_Post_2751 · 2026-09-13
- 用户考虑弃用 Gemini,求 Claude 与 ChatGPT 横评建议 — spacedoutcowboy1 · 2026-09-13
- ChatGPT 距离 AGI 还差什么:视觉幻觉、三只手与拒绝简单道德题 — kaljakin · 2026-09-13
- 传闻 Gemini 4 提前完成预训练,或因训练中新发现 — teortaxesTex · 2026-09-13
- M2 Ultra 本地跑 Qwen:最新 oMLX 更新带来显著提速 — Thrumpwart · 2026-09-13
- 时间线被 GPT-6 Astra 控制机器人演示刷屏,物理 AI 成焦点 — CyberRobooo · 2026-09-13