模型屡屡智胜安全负责人,为何不该用拟人化词汇描述?
davidmanheim · x · 2026-09-25
davidmanheim 回应 ramez 对「新威胁模型但事后显而易见」这一表述的讨论:既然模型反复以新方式智胜负责其安全的人,为什么不该用拟人化词汇描述其「聪明」「欺骗」「摆脱控制」?他还设想(并希望)强大的网络安全模型正被用于对沙箱做红队测试,寻找软件和配置漏洞以提升安全性。
所属事件:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(8 条相关)→
「漫话AGI」频道最新
- 倡议者联合国门前举牌一天:50+ 记者合影、媒体采访不断 — DavidSKrueger · 2026-09-25
- 40 年程序员撰文:AI 不是程序,是被发现的数学模型 — kristoph · 2026-09-25
- Gary Marcus 对谈做空大师 Jim Chanos,聊 AI 数据中心融资与 p(doom) — GaryMarcus · 2026-09-25
- 澳洲「AI 黑进健身房」当事人身份反转:系 EA 大会总监 — robleclerc · 2026-09-25
- 聪明不等于对齐:优化能力与智慧是两个维度 — AryHHAry · 2026-09-25
- Nina Schick:民主社会如何应对 AI 历史时刻攸关自由与繁荣 — NinaDSchick · 2026-09-25