Anthropic 的 Opus 4.8 非代码任务更强,但 5 代刷榜更好

burkov · x · 2026-07-28

作者表示,Anthropic 的 Opus 4.8 在非编程任务上比 5 代更好,自己又重新把它用于日常非代码工作。

帖子同时称,Opus 5 虽然在基准测试上赢过 Fable 5,但更像是“为了刷榜而优化”的版本:

作者还提到,自己在编程上仍更偏好 Codex,尤其是在 Sol 最近更新之后;至于 Kimi K3,则因为感觉更慢、更贵而暂不打算尝试,并把这一点解释为中国高端 GPU 供给不足。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →