Greenblatt 警惕 neuralese 架构:AI 或改用不透明激活思考
RyanGreenblatt · x · 2026-09-11
AI 安全研究者 Ryan Greenblatt 表示,他非常担心 AI 架构朝「neuralese」方向演化——即模型不再以可读的思维链(chain of thought)推理,而是改用不透明的激活状态进行内部思考,这将使人类失去监督模型推理过程的关键窗口。
他指出,基于有限的公开信息,Astra 似乎已是朝这个方向迈出的令人担忧的一步。更糟的是,公开发布的信息不足以支撑一场有据可依的科学讨论:外界无法判断这些架构变化究竟带来了什么影响。他附上了一份提案文件,呼吁提高透明度以便公共讨论。
所属事件:Redwood 提议披露架构,防 AI 思维链不可读(4 条相关)→
「漫话AGI」频道最新
- Gary Marcus 转文驳「2030 年 AI 灭绝人类」:不会灭世但严重风险须正视 — GaryMarcus · 2026-09-11
- Gary Marcus 讽刺 AGI 信徒论据:未来AI自会想到我们想不到的 — GaryMarcus · 2026-09-11
- 三十年技术老兵怒斥末日论者:AI安全记录史上级 — robleclerc · 2026-09-11
- Ronald Qiao:市场持续低估 AGI 可能性,高估停滞延续 — abhiadesai · 2026-09-11
- MILA 研究者翻出 2020 年旧帖:AGI 进度超前自己 7 年计划 — irinarish · 2026-09-11
- 「蜂群研究」提议:给 AI Agent 集群行为建一门社会学 — soumitrashukla9 · 2026-09-11