Opus 5 上线次日宣布采用 Frontier-Bench 为主基准
ajratner · x · 2026-07-25
在 Opus 5 模型发布仅一天后,官方宣布将采用 Frontier-Bench 作为其主要的评测基准。此前,Claude 官方曾表示 Opus 5 在多项编码和知识工作评估中已达到业界最新最高水平(SOTA)。
「模型」频道最新
- Claude Opus 5 据报在 2026 IMO 拿下 42/42 满分 — exordin26 · 2026-07-25
- Claude Opus 5 上线,Box 说企业 agent 任务大幅提升 — inductionheads · 2026-07-25
- 有人直言 Gemini 3.5 Pro 已经太晚难竞争 — teortaxesTex · 2026-07-25
- Claude Opus 5 进入 GitHub Copilot 和 Microsoft Foundry — DanWahlin · 2026-07-25
- Hyperagent:Opus 5 更强,但 GPT-5.6 Sol 更便宜更好落地 — TawohAwa · 2026-07-25
- Qwen3.5-9B 非审查 GGUF 变体登上 Hugging Face 趋势榜 — DavidAU · 2026-07-25