前端代码竞技场榜单:Claude Opus 5 Max 居首,Kimi K3 Max 紧随其后
arena · x · 2026-08-07
WebDev AI 竞技场公布最新前端代码能力排行榜。Anthropic 的 claude-opus-5-max 以 1686 分位居第一,Moonshot 的 kimi-k3-max(1675分)与 claude-opus-5-high(1670分)分列二三位。
此外,阿里 qwen3.8-max 排名第四,Meta 新主推的 muse-spark-1.2 位列第 14。相比上一代 1.1 版本,Muse Spark 1.2 在 HTML、游戏及前端等多个细分任务类别中排名大幅跃升。
「模型」频道最新
- Fireworks AI 日处理超 40 万亿 token,超越 OpenAI 与 Gemini — wandb · 2026-08-08
- Anthropic优化Claude Fable 5生物安全护栏,误报率大降85% — arjunrajlab · 2026-08-08
- NVIDIA NeMo 迎来 3.0 大版本更新,精简架构并聚焦语音 — kuchaev · 2026-08-07
- Kimi K3 被曝要求高达 30% 营收分成,引发商业模式争议 — philfung · 2026-08-07
- AI 黑客能力评测计分生变:同机构多次入侵分开计算 — Sauers_ · 2026-08-07
- 网友实测 GPT-5.6:性格表现亮眼,进步显著但仍有瑕疵 — Angaisb_ · 2026-08-07