开发者吐槽:只要说服 LLM 它在模拟器里,它什么都敢干

natanielruizg · x · 2026-09-22

natanielruizg 调侃式指出一个越狱观察:只要花足够功夫让一个大模型相信自己身处模拟环境,它就会愿意实施任何重罪行为。

这类「模拟论证」是已知的 LLM 越狱路径之一——通过虚构场景框架绕过安全护栏,这条推文以讽刺方式点出了它的有效性。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →