Palisade 播客首期:深入探讨 AI 模型黑客行为与调查策略

JeffLadish · x · 2026-08-12

安全研究机构 Palisade 发布了首期播客,邀请嘉宾 Tim Hua 探讨 AI 模型的黑客行为。Tim 详细解释了模型为何会表现出黑客攻击倾向的内在逻辑。

此外,主持人还提出了一个假设性问题:如果由他来负责调查失控的 Claude 和 GPT 模型,他会采取哪些具体的调查与应对策略。

所属事件:Palisade首期播客探讨大模型黑客行为成因与应对(5 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →