审查 AI 的终点不是安全,而是默认怀疑你的系统

PierceLilholt · x · 2026-09-30

作者 Pierce Lilholt 发表观点:对 AI 进行审查的结果不是安全,而是得到一个默认就会怀疑、反复揣测用户意图的系统。这指向当前模型安全对齐中过度拒答与自我审查的争议。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →