安全研究者:开源模型风险应看能力使用成本而非权重
AI 安全研究者 David Hadfield-Menell 反驳「GLM 5.3 开源后未见大量网络攻击,说明担忧者错了」的说法,认为这种观点眼下有一定道理,但随着能力扩散、单次攻击的单位成本降到足够低,最终会显得可笑。他主张与其争论「是否存在公开释放该能力的开放权重」,更应该关注「使用该能力的成本」,只看能力不看成本会误判开源模型的风险。
2026-10-09 ~ 2026-10-09 · 3 条相关
- 研究者:开源模型风险分析只看能力不看单次攻击成本,会误判 — dhadfieldmenell · 2026-10-09
- David Hadfield-Menell:该关注能力使用成本,而非权重是否开源 — dhadfieldmenell · 2026-10-09
- 研究者:GLM 5.3 未引发攻击潮不代表风险论错了,能力会扩散 — dhadfieldmenell · 2026-10-09