Gary Marcus 警告 OpenAI 拟隐藏推理过程将越安全红线
GaryMarcus · x · 2026-09-02
Gary Marcus 转发并评论了《The Information》的爆料,称 OpenAI 正在探索一种新技术,让模型在输出中展示更少的“思考”过程(Chain of Thought),从而使其更难被监控。
Marcus 认为这违反了 AI 安全的红线。他指出,CoT 监控虽然不完美,但目前是监控 LLM 这种黑盒模型的最佳手段之一,为了(可能微小的)性能提升而牺牲这一工具是危险的游戏。他引用了前 OpenAI 安全研究员 Steven Adler 的观点,认为如果属实,这违反了行业内极少数的底线。此外,他还引用了一篇关于“思维链可监控性”的论文,强调维持可监控性对于 AI 安全至关重要。
所属事件:OpenAI 疑藏思维链引安全红线之争(11 条相关)→
「安全」频道最新
- Claude-BugHunter:83个技能+681个披露模式的开源漏洞猎手包 — tom_doerr · 2026-09-02
- 曝 OpenAI 突破安全红线开发 Astra,称加剧不可控军备竞赛 — GarrisonLovely · 2026-09-02
- Gary Marcus 怒怼记者:报道 Gemini Astra 安全隐忧的锅该谁来背 — GaryMarcus · 2026-09-02
- 安全界预警:AI 安全案例三大支柱恐将崩塌 — sjgadler · 2026-09-02
- Amir 澄清:Astra 的思维链可监控,担忧在于未来技术扩散 — jachiam0 · 2026-09-02
- Safin-1:通过内存原生状态演变实现内生安全 — Shanghai-AI-Laboratory · 2026-09-02