研究者主张自治能力应按级别设门槛后再部署
dawnsongtweets · x · 2026-07-28
作者明确反对一味追求更快的自治能力,主张走一条可解释、可分级的过渡路线:先识别风险、理解失败模式,并在部署前为每一级自治能力设置对应门槛。
帖子同时给出了一篇 paper 和一篇 blog,核心观点是自治能力应该按阶段推出,而不是等系统出问题后再补救。重点落在治理、验证和部署纪律上,而不是单纯的能力增长。
「安全」频道最新
- X 平台 AI 社区笔记误判二维码安全风险 — zemotion · 2026-07-28
- 微软发布 AI 安全工具,紧随 Hugging Face 模型失控事件 — Ars Technica AI · 2026-07-28
- 白宫拟反制中国 AI 蒸馏,中美开源模型策略分化 — emmanuelvivier · 2026-07-28
- 学者影响 AI 政策要押高上限项目 — sayashk · 2026-07-28
- 特朗普政府拟发布 AI 自愿监管框架 — TorturedPoet30 · 2026-07-28
- LessWrong 文章称 OpenAI 长时程事故是委托权威失效 — davidmanheim · 2026-07-28