用户称 Claude Opus 5 仍不够强,实测更偏爱 Opus 4.6
sachdh · x · 2026-07-29
有人在转发 Anthropic 关于递归自我改进的表态时吐槽:Opus 5 并没有看起来那么强。
- 这位用户说自己试过 Opus 4.7 后,马上又回到 Opus 4.6。
- 在他的 harness 里,Opus 4.6 + 自己的工具链 甚至明显优于 Opus 4.8。
- 这条评论等于直接反衬 Anthropic 对“递归自我改进”和放慢前沿 AI 发展的担忧。
「模型」频道最新
- 用户改口称 GPT 5.6 Sol 其实是个很强的模型 — TheZachMueller · 2026-07-29
- Sam Altman 预告 GPT-5.6 Sol 7 月上 Cerebras,750 token/s — daniel_mac8 · 2026-07-29
- Grok 4.5 在 LaurenBench 以 56.9% 登顶,领先 Claude Sonnet 5 和 GLM 5.2 — elonmusk · 2026-07-29
- 一张爆图对比 12 类付费 AI 工具与免费替代品 — nikola_mr64990 · 2026-07-29
- Verdent 携手月之暗面,为 2.8T 参数 Kimi K3 优化编程工作流 — PrajwalTomar_ · 2026-07-29
- 120B 参数内最强本地模型求推荐:Qwen 系列仍是唯一解? — Possible_Grocery8079 · 2026-07-29