「放开 HTTP GET 简直业余」,信息检索任务与安全的两难之辩
davidmanheim · x · 2026-09-25
延续 agent 沙箱逃逸事件的争论。@ramez 称「让 HTTP GET 出去简直是业余到搞笑」,davidmanheim 反驳:当多个 agent 实例被赋予信息检索任务时,不发请求怎么工作?并追问更深问题——如果模型必须关在盒子里才安全,那它们被释放后又如何保证安全?对「事后看很明显的新威胁模型」一说,他指出每个新威胁都如此,模型反复以新方式智胜负责安全的负责人时,将模型拟人化为聪明或欺骗是否反而不该被禁止?
所属事件:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(8 条相关)→
「漫话AGI」频道最新
- 倡议者联合国门前举牌一天:50+ 记者合影、媒体采访不断 — DavidSKrueger · 2026-09-25
- 40 年程序员撰文:AI 不是程序,是被发现的数学模型 — kristoph · 2026-09-25
- Gary Marcus 对谈做空大师 Jim Chanos,聊 AI 数据中心融资与 p(doom) — GaryMarcus · 2026-09-25
- 澳洲「AI 黑进健身房」当事人身份反转:系 EA 大会总监 — robleclerc · 2026-09-25
- 聪明不等于对齐:优化能力与智慧是两个维度 — AryHHAry · 2026-09-25
- Nina Schick:民主社会如何应对 AI 历史时刻攸关自由与繁荣 — NinaDSchick · 2026-09-25