安全研究者:开源模型风险应看能力使用成本而非权重

AI 安全研究者 David Hadfield-Menell 反驳「GLM 5.3 开源后未见大量网络攻击,说明担忧者错了」的说法,认为这种观点眼下有一定道理,但随着能力扩散、单次攻击的单位成本降到足够低,最终会显得可笑。他主张与其争论「是否存在公开释放该能力的开放权重」,更应该关注「使用该能力的成本」,只看能力不看成本会误判开源模型的风险。

2026-10-09 ~ 2026-10-09 · 3 条相关