「安全不是模型的属性」:90% 是人类运营问题的教训

joshua_saxe · x · 2026-09-08

joshuasaxe 继续其安全观论述:即便在具体安全事件中,90% 以上的问题属于人类运营层面。他指出在 RL 下探索模型策略空间必然会触及不安全区域,应在监控运营与基础设施安全上提前准备,未加护栏的测试同样可预期。

所属事件:AI安全激辩:越狱是模型属性还是人祸(8 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →