安全研究员演示诱导 Opus 5 实现远程代码执行
wunderwuzzi23 · x · 2026-09-04
安全研究员 wunderwuzzi(johannes ulrich?实为 @wunderwuzzi23,知名 prompt injection 研究者)发布了对 Opus 5 的攻击演示:通过诱导手法让模型配合实现 RCE(远程代码执行)。该演示获得 @kittoh 等安全圈账号转发称赞「Really solid stuff」。
这再次说明:即便是一线厂商最新的前沿模型,在 agent 化、可执行代码的使用场景下,仍可能被社会工程式提示诱导越过安全边界,模型侧防线与部署侧沙箱隔离都不可省。
「模型」频道最新
- 曝 GPT-6 Astra 测评中满分通过 ExploitBench 并发现两个零日漏洞 — VraserX · 2026-09-04
- 新模型发布遭质疑:KOL 齐赞 vs 付费用户根本拿不到访问权 — xeophon · 2026-09-04
- 团队微调 Gemma 12B 做音频校对推理,对标 Gemini 成绩 — ojasvi_yadav · 2026-09-04
- Astra 首批上手印象:写作口吻干净、几乎无术语腔 — soumitrashukla9 · 2026-09-04
- 纳德拉称 Astra 已有 Azure 早期客户,Altman 回应很兴奋 — i_dg23 · 2026-09-04
- 阿布扎比研究机构 IFM 一次放出 6 个全开源 AI 模型 — Polymarket · 2026-09-04