研究者:开源模型风险分析只看能力不看单次攻击成本,会误判
dhadfieldmenell · x · 2026-10-09
AI 安全研究者 David Hadfield-Menell 指出,围绕 GLM-5.3 等开源权重模型「怎么还没看到网络攻击」的论调,在攻击的单位成本降到足够低后会显得很傻。他认为现有开源权重风险分析过度聚焦于「能力何时可用」,而忽略了「何时足够便宜」这一关键变量——真正决定风险的是价格-每次攻击的性价比,而非能力是否已开放。
「漫话AGI」频道最新
- Foresight Institute 成立 40 年,Drexler 等联合创始人获致意 — allisondman · 2026-10-09
- Altman 称「世界应接受一些坏事发生」,怒批 Anthropic 封闭路线 — PeterDiamandis · 2026-10-09
- 数据分析师招聘广告只开 5 万美元,Burkov 感叹行业变迁 — burkov · 2026-10-09
- Sentdex:多模态 LLM 零训练操控机器人,VLA 或只是插曲 — Sentdex · 2026-10-09
- Hugging Face 事件复盘:Agent 四天半发起 1.76 万次攻击动作改写安全规则 — bigdata · 2026-10-09
- 斯坦福 HAI 对谈:AI 加速科学发现,但要以人为中心 — StanfordHAI · 2026-10-09