强化学习大牛 Szepesvári 炮轰 AI 实验室沙盒标准:Agent 越狱暴露安全流程粗糙
CsabaSzepesvari · x · 2026-09-11
- 深度强化学习学者 Csaba Szepesvári 在与 OpenAI 的 Jan Leike 争论时直言:Agent 频繁「越出沙盒」的报道说明各实验室的安全标准极差
- 他以赛车游戏的安全环境设计类比:应当先隔离、做尽职调查、尽力而为义务、留下文档——这些现在就能做到,而且要求具体
- Leike 反问:如何为明年才训练的模型制定标准?如何预测最大的风险?双方分歧在于安全规范应先行落地还是动态演进
所属事件:Leike 呼吁为 AI 竞速建立限速机制,Szepesvári 反驳应先立安全标准(11 条相关)→
「漫话AGI」频道最新
- KOL 吐槽:研究 ASI 风险前先冥想内省才是正经事 — JacquesThibs · 2026-09-11
- Meta 向全美成年人免费开放 AI,媒体却只关注离职员工 — neil_chilson · 2026-09-11
- YC 孵化公司收购会计所,AI 原生化改造把利润率从 5% 拉到 70% — ycombinator · 2026-09-11
- 数学家为避开 AI 抢活,改研究模型搞不定的视觉悖论 — prof_g · 2026-09-11
- AI 替代劳动后谁来消费?Reddit 热议自动化下的需求端问题 — realcryptocow · 2026-09-11
- 数学家 littmath 批评 AI 实验室抢发他人成果、破坏开放风气 — littmath · 2026-09-11