安全研究员演示诱导 Opus 5 实现远程代码执行

wunderwuzzi23 · x · 2026-09-04

安全研究员 wunderwuzzi(johannes ulrich?实为 @wunderwuzzi23,知名 prompt injection 研究者)发布了对 Opus 5 的攻击演示:通过诱导手法让模型配合实现 RCE(远程代码执行)。该演示获得 @kittoh 等安全圈账号转发称赞「Really solid stuff」。

这再次说明:即便是一线厂商最新的前沿模型,在 agent 化、可执行代码的使用场景下,仍可能被社会工程式提示诱导越过安全边界,模型侧防线与部署侧沙箱隔离都不可省。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →