实验室被曝抢跑「神经语」传闻,Redwood 提案呼吁守住 CoT 可监控性
RyanGreenblatt · x · 2026-09-11
Anthropic 对齐团队 Ryan Greenblatt 转发 Redwood Research 的新提案。背景是此前有传闻称各实验室在抢跑「neuralese」(神经语,即不可读的隐式推理),虽然目前并不属实,但已使思维链(CoT)可监控性的具体承诺变得更紧迫——因为激励会自然滑向不透明的架构。
- Redwood 指出某些架构可能削弱 CoT 可监控性,甚至完全取消思维链
- 提案建议公司就「无 CoT 推理能力」保持透明,公开其他可监控性证据,并制定保留可监控性的政策
- Greenblatt 希望 OpenAI、Anthropic 等公司能围绕该提案形成共识
所属事件:Redwood 提案:披露无 CoT 架构,守住 AI 可监控性(5 条相关)→
「安全」频道最新
- Gary Marcus:末日论调转移视线,OpenAI 们的安全工程根本不及格 — GaryMarcus · 2026-09-11
- Meta 携手 Signal 创始人 Moxie 打造加密虚拟机,宣称连扎克伯格也看不到你的数据 — ThomasScialom · 2026-09-11
- 试图蒸馏 Claude 反把涉密数据传到美国,成 AI 圈名场面 — Afinetheorem · 2026-09-11
- 美国 GSA 谈下 ChatGPT 模型 token 五折价,扩大联邦政府 AI 采购 — Felipe_Millon · 2026-09-11
- TurnTrout:AI 灭绝人类的关键节点是“失控”而非直接杀伤 — Turn_Trout · 2026-09-11
- ITIF 研究员撰文:如何为不同 AI 风险匹配合适的政策工具 — ArtificialOther · 2026-09-11