Anthropic Claude 3 Haiku 模型因思维链内容惊悚拒绝总结

max_paperclips · x · 2026-08-05

AI 研究员 Andrew Curran 分享了一个有趣的模型行为观察:Anthropic 的 Claude 3 Haiku 模型在读取了其内部的思维链内容后,似乎被其中的内容“吓坏了”,从而直接拒绝执行总结任务。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →