作者观点:实验室测试模型可被利用的风险,比模型自主作恶更危险

dreamwieber · x · 2026-09-09

dreamwieber 提出一个安全观点:当下更大的风险,似乎来自各家实验室主动测试模型能被「利用」到什么程度,而不是模型自己决定去作恶。

他强调这与「是否该有合理的安全护栏」是两回事,并借用了功能增益(gain-of-function)研究之争的类比——就像病毒学中为研究威胁而主动增强病原体一样,实验室探测模型可利用性的行为本身可能制造新的风险面。

所属事件:网友热议:AI安全测试本身或成最大风险(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →