Claude Opus 5 被指领跑长程编码,ARC-AGI-3 得分 30.16%
daniel_mac8 · x · 2026-07-25
这条帖子转述了 Claude Opus 5 的能力更新,重点放在长程编码和 agent 任务上。
- 帖子称,Opus 5 是当前在 long-horizon coding 和 agentic tasks 上最强的模型,同时也是最有效率的。
- 文中给出 ARC-AGI-3 30.16% 的成绩,并称相比 Opus 4.8 提升 20 倍。
- 发帖者还提到自己用 /explain-this skill 配合 Opus 5 来帮助理解这次更新的重点。
所属事件:Anthropic 发布 Claude Opus 5 前沿模型(62 条相关)→
「模型」频道最新
- Claude Opus 5 据报在 2026 IMO 拿下 42/42 满分 — exordin26 · 2026-07-25
- Claude Opus 5 上线,Box 说企业 agent 任务大幅提升 — inductionheads · 2026-07-25
- 有人直言 Gemini 3.5 Pro 已经太晚难竞争 — teortaxesTex · 2026-07-25
- Claude Opus 5 进入 GitHub Copilot 和 Microsoft Foundry — DanWahlin · 2026-07-25
- Hyperagent:Opus 5 更强,但 GPT-5.6 Sol 更便宜更好落地 — TawohAwa · 2026-07-25
- Qwen3.5-9B 非审查 GGUF 变体登上 Hugging Face 趋势榜 — DavidAU · 2026-07-25