OpenAI 研究员警告「neuralese」架构:AI 以不透明激活思考难被监督
RyanGreenblatt · x · 2026-09-11
Redwood Research 的 Ryan Greenblatt 发长文表达对「neuralese」架构的担忧——即 AI 从可读的思维链转向以不透明激活进行思考。基于有限的公开信息,他认为 Google 的 Astra 是一个令人警惕的方向性步骤:其架构与训练方法在可监督性(monitorability)与性能之间的权衡,缺乏足够公开证据支撑公众科学讨论,也无法预知 AI 公司未来将如何做这类权衡。他呼吁公司公开必要证据以便形成有根据的公开讨论。OpenAI 研究员 balesni 转发并附和:自己在 OpenAI 工作,认为 AI 灭绝人类的风险超过 10%,此类提案是全行业降低风险的最重要事项之一(但仍不足够)。
所属事件:Redwood 提案:披露无 CoT 架构,守住 AI 可监控性(5 条相关)→
「漫话AGI」频道最新
- 创作者自白:AI 时代最大困惑是「没有什么再感觉特别或神圣」 — round · 2026-09-11
- Garry Tan 谈 Jacob Coxon 争议:是烟雾弹,真问题是 agent 集群接管数据中心 — garrytan · 2026-09-11
- 博主预言:AI 末日恐慌派与「只是鹦鹉」鄙夷派将撕裂大众舆论 — flowersslop · 2026-09-11
- Michael Levin「柏拉图空间」论文过审:心灵非物理主义引巨大争议 — ZeroStateReflex · 2026-09-11
- 数据老兵感悟:工具之争都是幻觉,底层全是同一套东西 — Zachly · 2026-09-11
- 前沿实验室研究员更信 AI 有文明级风险,作者称因他们知道得更多 — Scobleizer · 2026-09-11