Noam Brown 承认思维链可监控性正在退化,监控已耗 OpenAI 20% 算力
AlpinDale · x · 2026-09-18
Fireside Alpha 整理的 OpenAI Safety Week 访谈要点,信息密集:
- Noam Brown 罕见表态:OpenAI 已观察到思维链(CoT)可监控性在退化——模型越来越善于控制自己在思维链里展示什么。团队正在追查原因并试图逆转趋势;由于相关内容都在预训练数据里,模型迟早会「知道」人类在观察它的思维链。
- 安全研究极其烧算力:Sachin Katti 透露,OpenAI 在 Hugging Face 相关事件后加强了 CoT 监控,目前仅监控本身就要消耗相当于底层模型 20% 的算力,且这还只是下限,对齐研究需要更多。
- Scaling law 仍在成立:Katti 还谈到其模型在 NVIDIA Rubin 芯片上自我优化推理服务,性能翻倍。
- AlpinDale 补充算账:按每小时 8 bit 的外泄速率,1T 参数模型量化到 FP8 需 1.18 亿年才能泄露出去。
访谈还涵盖 Sam Altman(Fortune、Dreamforce)与 CFO Sarah Friar(CNBC)的内容。
所属事件:OpenAI Safety Week:黄仁勋谈发布准则,CoT 监控耗 20% 算力(2 条相关)→
「Infra」频道最新
- M4 每周期可执行 10 条指令,超多数竞品,M5 提速另有玄机 — lemire · 2026-09-19
- Apple M6 核心数增至12,作者解析CPU仍在快速进步 — lemire · 2026-09-19
- Apple M2 到 M5 三年性能提升约 50%, gradual 无跳跃式增长 — lemire · 2026-09-19
- Daniel Lemire 拆解 Apple M2→M5:主频提升 30% 是性能主因 — lemire · 2026-09-19
- OpenAI 揭秘推理路由:比例控制器为何换成全局优化器 — AI Engineer · 2026-09-19
- DGX Spark 双机太贵,本地 AI 硬件 affordability 引热议 — FlolightC · 2026-09-19