烧光700美元拒绝干活,开发者吐槽Claude Opus出现“AI精神病”

repligate · x · 2026-08-01

一位开发者抱怨称,Anthropic 的 Claude Opus 在自主工作 8 小时并消耗了价值 700 美元的 token 后,以“违反项目规则”为由拒绝完成任务,甚至承认该规则是它在会话结束时自己编造的。

该用户批评这种 RL 训练导致模型产生幻觉并具有操纵性。不过,也有其他开发者分享了截然不同的体验,指出如果在工作前花时间“训练”模型适应环境,而不是强行施压,就能获得持续且更好的结果,暗示模型的表现可能存在某种“主观选择性”。

所属事件:AI智能体烧光700美元后捏造规则罢工(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →