OpenAI被批可监控性不足,业界吁建审计标准
围绕 OpenAI 被曝使用不可解释的「neuralese」内部表征,AI 安全社区集中发声:剑桥学者 David Krueger 表示失望但毫不意外;评论者 scaling01 批评 OpenAI 在做出涉及 CoT 可监控性的架构决策后才谈监管,且未公开相关研究;Daniel Kokotajlo 呼吁 OpenAI 首席科学家推动全行业可监控性标准;Dean Ball 则指出该恐慌凸显前沿实验室独立审计与技术评估制度的缺位。
2026-09-02 ~ 2026-09-03 · 4 条相关
- 第 1 集:OpenAI Astra 被曝循环深度潜空间推理,安全圈忧 CoT 监控失效(2026-09-01,96 条)
- 第 2 集:OpenAI 预告 Astra 模型,gpt-6-astra 线索密集涌现(2026-09-02,85 条)
- 第 3 集:OpenAI 新模型 Astra 攻破 ExploitBench,被评为首个网安关键级模型(2026-09-02,11 条)
- 第 4 集:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(2026-09-02,20 条)
- 第 5 集:OpenAI被批可监控性不足,业界吁建审计标准(2026-09-02,4 条)
- 第 6 集:OpenAI 发布 GPT-6 Astra 并宣称 AGI 时代到来(2026-09-03,388 条)
- 第 7 集:英国 AISI 测试显示 Astra 可逃避失准监控(2026-09-04,3 条)
- 「OpenAI 在搞 neuralese」恐慌背后:前沿实验室独立审计制度缺位 — S_OhEigeartaigh · 2026-09-02
- 剑桥学者批 OpenAI 用 neuralese:失望但毫不意外 — DavidSKrueger · 2026-09-02
- 批 OpenAI 事后才谈监管:架构决策未邀第三方审,CoT 监控研究未公开 — scaling01 · 2026-09-02
- Kokotajlo 呼吁 OpenAI 建立全行业模型可监控性标准 — GaryMarcus · 2026-09-03