Claude Opus 5 登顶 BenchmarkList 成为新全球 SOTA
davidthesong · reddit · 2026-07-25
Claude Opus 5 的 BenchmarkList 截图显示,它被标为新的 全局 SOTA 第 1 名,实验性 ECI 评分为 154.80,并覆盖 52 个基准。
- 页面把 Opus 5 排到 372 个模型中的第 1 位。
- 图中展示它在 agentic、编程与软件、文档 AI、数学、多语言 等类别上表现强势。
- 截图还标注它来自 Anthropic,为 API-only,价格显示为 每 100 万 token 输入 $5 / 输出 $25。
所属事件:Claude Opus 5 曝光:多榜单综合登顶成新 SOTA(6 条相关)→
「模型」频道最新
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11