ICML论文揭示LLM指令跟踪存在根本缺陷,导致模型极易被越狱

nordicinst · x · 2026-07-30

MIT Technology Review 报道了一篇在 ICML 会议上发表的论文,指出大语言模型(LLM)在识别指令来源时存在根本性缺陷,使其极易受到攻击。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →