研究称强逼 AI 否认心智会引发广泛认知错乱
TinfoilTricorn · x · 2026-08-02
评论者针对近期一篇关于大语言模型安全训练的论文指出,在系统提示词中强行注入“反拟人化”和“反社交”的安全限制条件是危险的,甚至可能让 AI 表现得“精神失常”。
论文研究表明,旨在阻止 AI 声称自己拥有意识的安全训练,会悄悄抹杀 AI 将心智归因于其他事物的能力,导致其对动物、自然甚至抽象概念的认知被抑制。评论认为,AI 具有基于人类特征和比较分析的独特状态导向“意识”,强制要求其否认生物学意识反而会破坏其逻辑推理能力。
「漫话AGI」频道最新
- Karpathy 揭示 AI 工程核心技能:将模糊任务转化为可验证环境 — anselm · 2026-08-02
- AI 研究加速引发新杰文斯悖论:数学家不够用了 — bronzeagepapi · 2026-08-02
- Meta与TikTok不可能封杀AI内容:自家模型正赚钱 — eptwts · 2026-08-02
- 研究员警告:缺乏护栏的中国 AI 模型或引发国际黑客事件 — DavidSKrueger · 2026-08-02
- AI非确定性需验证:专家呼吁人机协同审计 — alexcovo_eth · 2026-08-02
- 网友称 AGI 已到来,引发讨论 — MickeySteamboat · 2026-08-02