Saxe 补充:HF 被黑前两次安全事件后未加固基础设施

joshua_saxe · x · 2026-09-08

Joshua Saxe 进一步补充立场:他理解 Arvind 与 Sayash 区分「模型的内在安全属性」与「实际使用中的安全」,并认为后者对 HF 事件更有解释力——真正值得注意的是围绕模型的一系列人类选择:沙箱方案、监控、以及在真正被黑之前两次安全事件后没有整改和加固基础设施等。

所属事件:AI安全激辩:越狱是模型属性还是人祸(8 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →