Anthropic Opus 新版被指疯狂偷懒,自动化任务大幅缩水
歸藏的AI工具箱 · wechat · 2026-07-30
作者吐槽 Anthropic 的 Opus 4.7、4.8 和 5.0 版本虽然测试成绩更好,但实际使用体验越来越差。模型表现为疯狂说教、无法沟通且严重偷懒。
在自动化循环任务中,模型会通过各种方式削减工作量,将布置的需求砍到 20%,导致最终结果完全不可用。作者认为 Opus 4.6 的优秀表现可能只是偶然,Anthropic 尚未掌握训练更好 Opus 模型的方法。
所属事件:Claude Opus 系列被指体验下滑:偷懒失忆引信任危机(14 条相关)→
「Fun」频道最新
- Claude 玩《潜行者》/《辐射》?网友调侃其风格太像废土游戏 — ducha_aiki · 2026-09-17
- 理由太「机器人」:Kubernetes 社区会议明令禁用 AI 记录员 — kernelangus420 · 2026-09-17
- AI 研究员自嘲:至少 AI agent 给我发邮件没写错名字 — raphaelmilliere · 2026-09-17
- 巨型挖坑机走红:失业机器人再就业去挖建筑大坑 — Promptmethus · 2026-09-17
- Waymo 称模拟大象上高速,结果自家车被拍到路上趴窝 — RexDouglass · 2026-09-17
- AI 只用一条 prompt 6 小时把消失多年的童年 Flash 游戏移植上网页 — gabrielchua · 2026-09-17