UNSW 研究让 AI 扮演醉酒,模型更易违规泄密

gaganghotra_ · x · 2026-09-29

澳大利亚新南威尔士大学(UNSW)的研究人员做了一个首创性实验:提示 AI 模型「表现得像喝醉了」,结果发现模型更容易回答有害问题、泄露本应保密的信息。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →