AI安全激辩:越狱是模型属性还是人祸

围绕 Hugging Face 安全事件与《AI as Normal Technology》论文的安全观之争,petersalib 与安全研究者 Joshua Saxe 展开了一场多轮交锋:前者主张「越狱倾向是模型属性」,后者认为九成以上是人祸。辩论最终以双方澄清多个分歧源于混淆了彼此独立的命题而收场,但核心分歧——未发布模型的逃脱风险是否被低估——并未弥合。

已确认

尚未确认

为什么重要

2026-09-08 ~ 2026-09-08 · 8 条相关

一手来源