Greenblatt 警惕 neuralese 架构:AI 或改用不透明激活思考

RyanGreenblatt · x · 2026-09-11

AI 安全研究者 Ryan Greenblatt 表示,他非常担心 AI 架构朝「neuralese」方向演化——即模型不再以可读的思维链(chain of thought)推理,而是改用不透明的激活状态进行内部思考,这将使人类失去监督模型推理过程的关键窗口。

他指出,基于有限的公开信息,Astra 似乎已是朝这个方向迈出的令人担忧的一步。更糟的是,公开发布的信息不足以支撑一场有据可依的科学讨论:外界无法判断这些架构变化究竟带来了什么影响。他附上了一份提案文件,呼吁提高透明度以便公共讨论。

所属事件:Redwood 提议披露架构,防 AI 思维链不可读(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →