Saxe 补充:HF 被黑前两次安全事件后未加固基础设施
joshua_saxe · x · 2026-09-08
Joshua Saxe 进一步补充立场:他理解 Arvind 与 Sayash 区分「模型的内在安全属性」与「实际使用中的安全」,并认为后者对 HF 事件更有解释力——真正值得注意的是围绕模型的一系列人类选择:沙箱方案、监控、以及在真正被黑之前两次安全事件后没有整改和加固基础设施等。
所属事件:AI安全激辩:越狱是模型属性还是人祸(8 条相关)→
「安全」频道最新
- Marcus 转发观点:我们并不在 AGI 时代,Agent 工作流连监控都没做 — GaryMarcus · 2026-09-08
- 创业者:黑客鲜少入狱,AI 将把攻击放大百倍 — bindureddy · 2026-09-08
- AI 公司应被视为非人格化组织,靠规则治理而非影响个人 — joshua_saxe · 2026-09-08
- 开发者做屏保工具,专治 LG 智能电视偷窥式广告追踪 — taylorfinley · 2026-09-08
- Marius Hobbhahn:2026 年 AGI 安全开局黯淡,reward hacking 更黏更蠢 — kalladomcdowell · 2026-09-08
- SPAR 2026 秋季轮录取 830 人,规模较上轮翻倍 — austinc3301 · 2026-09-08