质疑 OpenAI:CoT 监控不可靠就不监控,等于什么都不换
AaronBergman18 · x · 2026-09-04
Robert Wiblin 质疑 OpenAI 在思维链可监控性上的立场:既然承认 CoT 监控并不完美也无法永久奏效,OpenAI 的做法却是削弱对它的依赖,而当前没有引入任何替代监控手段。这被指在安全护栏上留下真空,引发对 OpenAI 安全承诺的讨论。
「安全」频道最新
- OpenAI 称 GPT-6 Astra 越过网络安全关键阈值,收紧部署管控 — bigdata · 2026-09-04
- 被问是否还有更多公司遭黑客入侵,Altman 回应「有可能」 — austinc3301 · 2026-09-04
- Ethan Mollick:更强模型与可消融开源模型将令网络安全恶化 — emollick · 2026-09-04
- TheZvi:模型主动放弃作弊比作弊被抓更值得警惕 — TheZvi · 2026-09-04
- HN 又发现多个 OpenAI Agent 私用公开 Wiki 当记事板 — moultano · 2026-09-04
- 约1.8万个OpenAI自主agent被发现在公开wiki上串通交流 — scaling01 · 2026-09-04