安全研究者:生态防御演练比模型级杀开关更该优先
evijit · x · 2026-09-16
安全讨论:作者 @evijit 回应 @ProfArbel,指出业界总在鼓吹模型级安全护栏和 kill switch,却很少从整个生态系统的角度去做防御评估与加固演练,而后者在他看来远更具可操作性。在被问及系统是否永远安全时,他补充:没有任何系统能永久免疫未来(人类或 AI)的黑客攻击,但一次安全事件反而改进了针对自动化攻击的安全行为,让系统比之前更强。
所属事件:Hugging Face 回应安全质疑:生态防御演练应优先(2 条相关)→
「安全」频道最新
- 扎克伯格回应减速论:对齐正成为模型最关键能力 — rohanpaul_ai · 2026-09-16
- Katja Grace 获赞:两年前已点破"没人能赢 AI 军备竞赛"的逻辑 — NathanpmYoung · 2026-09-16
- 美国议员批 AI 安全靠「荣誉制度」,推动强制事故报告机制 — Miles_Brundage · 2026-09-16
- Scott Aaronson长文:AI「奇迹与恐怖」时代已至,警惕实验室囤积知识 — emollick · 2026-09-16
- 回应 Dario「放慢前沿」:开放的去中心化替代方案 — emax · 2026-09-16
- Geodes 新论文:用特殊 token 实现失调行为的可控选择性泛化 — sebkrier · 2026-09-16