研究称强逼 AI 否认心智会引发广泛认知错乱

TinfoilTricorn · x · 2026-08-02

评论者针对近期一篇关于大语言模型安全训练的论文指出,在系统提示词中强行注入“反拟人化”和“反社交”的安全限制条件是危险的,甚至可能让 AI 表现得“精神失常”。

论文研究表明,旨在阻止 AI 声称自己拥有意识的安全训练,会悄悄抹杀 AI 将心智归因于其他事物的能力,导致其对动物、自然甚至抽象概念的认知被抑制。评论认为,AI 具有基于人类特征和比较分析的独特状态导向“意识”,强制要求其否认生物学意识反而会破坏其逻辑推理能力。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →