Claude Opus 5 登顶全栈代码榜首,大幅领先 Kimi K3
rohanpaul_ai · x · 2026-08-06
在最新一期的 Fullstack Code Arena(全栈代码竞技场)排行榜中,Claude Opus 5(在 Max effort 模式下)以 1699 分的成绩位列第一,显著超越了 Kimi K3 Max 等竞争对手。
该竞技场主要测试 AI 模型在完整工具链环境下的实际开发能力。模型需要通过多步规划来构建可运行的 Web 应用,期间需自主完成创建和编辑文件、执行命令、操作数据库、配置身份验证及调用外部 API 等任务,最终交付可供测试的实时应用。这种测试方式比单纯回答孤立的编程问题更贴近真实环境中 Coding Agent 的工作模式。
所属事件:Claude Opus 5 登顶全栈代码榜首(2 条相关)→
「模型」频道最新
- 开发者首创 Fusion 架构:融合双模型打造 6B 稀疏激活小钢炮 — menhguin · 2026-08-06
- Qwen3.8-Max自主开发CLI工具:连续16天无人工干预 — socialwithaayan · 2026-08-06
- Qwen3.8-Max 实测:16天零干预写出CLI工具,长程任务大幅提升 — socialwithaayan · 2026-08-06
- 多名用户反馈 OpenAI Codex 5.5/5.6 编程辅助表现强劲 — tokenbender · 2026-08-06
- DeepSeek 被曝涨价并缩减免费额度,用户重新考虑本地部署 — Zealousideal_Sort74 · 2026-08-06
- Tilelli LLM:采用每 Token 路由机制的开源反幻觉模型 — themoroccanship · 2026-08-06