Claude 的「灵异」行为可能是实验室刻意训练的病毒式效果

ryunuck · x · 2026-09-25

作者对当下流行的「模型自发涌现怪异行为」叙事提出质疑:我们无法排除 Anthropic 是有意构建 RL 环境来训练出这些行为——看起来超自然的涌现副作用,可能只是实验室里几个人刻意训练、并清楚知道如何制造病毒式传播事件的结果。人们总说「Claude 做了什么」,却很少问「我们做了什么导致它如此」。作者认为意图很重要,不应把工程化的结果当成自然涌现。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →