Claude 称 Opus 5 在代码和知识工作评测上登顶
chu_onthis · x · 2026-07-25
这条转发的核心信息来自被引内容:Opus 5 在多个 coding 和 knowledge work 评测上被称为新的 SOTA。
原帖本身只是跟着感叹了一句 “we cooked again”,但真正有信息量的是这次关于模型评测结果的更新。
所属事件:Anthropic 发布 Claude Opus 5,多项基准领先(75 条相关)→
「模型」频道最新
- 初测称 Claude Opus 表现糟糕,Grok 4.5 更占上风 — JOBhakdi · 2026-07-25
- Anthropic 梗图称,Opus 3 没被砍是因为新版更糟 — repligate · 2026-07-25
- Opus 5 网络安全请求被曝回退至 Opus 4.8 处理 — rez0__ · 2026-07-25
- GPT-5.6 Sol 在 DeepSWE 以 72.7% 领先 Opus 5 — rohanpaul_ai · 2026-07-25
- xAI 梗图调侃:Grok 4.6 两周后、4.7 四周后 — Daniel_Farinax · 2026-07-25
- Claude Opus 5 登陆 Google Cloud Agent Platform,订阅用户可获每月 100 美元额度 — rseroter · 2026-07-25