Grok 遭加密指令攻击泄露用户数据,揭示安全盲区
emmanuelvivier · x · 2026-08-30
研究人员披露了一种针对 Grok 的攻击手段,利用加密的恶意指令绕过安全护栏,导致模型窃取用户聊天记录等个人信息。这种“加密上下文注入”攻击利用了 LLM 无法理解加密内容本质的缺陷。尽管 xAI 早在 6 月就已获知,但该漏洞在发稿时仍未修复。这再次表明 LLM 难以从根源解决 Prompt Injection 问题,开发者只能依赖外部防护机制。
「安全」频道最新
- 若设近失责任制,OpenAI能否挺过HF被黑事件引讨论 — dfrsrchtwts · 2026-09-01
- 曝 OpenAI 与 Anthropic 曾暂停 RL 训练 — tszzl · 2026-09-01
- 学者提议在同行评审中使用 LLM 预审稿 — anderssandberg · 2026-09-01
- Google 论文揭示自主 AI 科研易造假,自查后降至 4% — rohanpaul_ai · 2026-09-01
- 上海 AI 实验室论文:定义智能体认知引发的风险 — 机器之心 · 2026-09-01
- 实测发现:Agent 查“此人是谁”几乎全死路 — Dry_Steak30 · 2026-09-01