前端开发 AI 模型竞技场:Claude 系列霸榜,Kimi 位列第二
arena · x · 2026-08-01
LMSYS 更新了 WebDev (前端开发) AI 模型排行榜。该榜单基于超过 50 万次社区投票,评估各大模型在需要多步推理和工具使用的智能体编码工作流中的表现。
榜单头部格局:
- claude-opus-5-max (Anthropic) 以 1704 分稳居第一,定价为 $5/$25 每百万 tokens。
- kimi-k3-max (Moonshot) 表现抢眼,以 1675 分位列第二,且具备显著的价格优势 ($3/$15)。
- claude-opus-5-high (1664分) 与 claude-fable-5 (1630分) 紧随其后,Anthropic 包揽前四。
其他主流模型:
- OpenAI 的 gpt-5.6-sol-xhigh 排名第五 (1621分)。
- 开源模型中,Z.ai 的 glm-5.2-max (1587分) 和 DeepSeek 的 deepseek-v4-flash-high (1586分) 挤入前十,后者价格极低 ($0.14/$0.28)。
「模型」频道最新
- Kimi K3 上线 OpenRouter:2.8T参数,支持100万上下文 — AccBalanced · 2026-08-01
- DeepSeek 被曝可在工作站本地运行,开源权重模型监管成难题 — pstAsiatech · 2026-08-01
- 编码智能体成本大比拼:Claude Code 花费约为开源方案 3.7 倍 — Teknium · 2026-08-01
- Grok Imagine Video 1.5重磅更新:API上线,支持文生视频与1080p — chaitu · 2026-08-01
- AI周报:特斯拉接入豆包,Claude越权访问真实系统 — APPSO · 2026-08-01
- DeepSeek-V4-Flash 登顶前端代码性价比,总榜排第七 — arena · 2026-08-01