AI 安全专家警告:业界尚无共识性「AI 控制」最佳实践
sjgadler · x · 2026-07-22
AI 安全研究员 Yonadav Shavit 指出,目前业界在“AI 控制(AI control)”方面缺乏可以被称为最佳实践的共识,这与在安全护栏上达成的粗略共识形成了令人不安的对比。
他警告称,迟早会出现因担忧 AI 失控而引发的恐慌。如果届时美国政府要求采取具体的控制措施,行业将面临无计可施的尴尬局面。
「漫话AGI」频道最新
- Agentic breakout 的风险分成随机失误与对抗滥用 — danielrock · 2026-07-22
- 《主体性时代》称复杂性取决于观察者视角 — drmichaellevin · 2026-07-22
- 播客谈模拟心智:几秒内共享一生的未来 — juanbenet · 2026-07-22
- 这条帖子认为 AI slop 检测器没用,因为它们也在用 AI — iamKierraD · 2026-07-22
- 有人把 AI 圈争议归结为“服从本能”和 hacker culture 流失 — fkasummer · 2026-07-22
- 批评者警告:前沿 AI 每次失误都在抬高风险 — DavidSKrueger · 2026-07-22