推理提取攻击两月后仍未根治,Astra 漏洞持续可复现
jonasgeiping · x · 2026-10-01
jonasgeiping 团队发布推理提取攻击两月后的审计更新:kotekjediml 引用的发现称,经第三方 API 提供商,仍可提取 Astra/Sol-6.1 的推理内容,并已向 OpenAI 与 Anthropic 披露。团队指出各前沿厂商都难以彻底修补该漏洞,针对 Astra 的攻击直到本周前仍有效。报告已发布,OpenAI 近期报告亦有更多信息。
所属事件:推理提取攻击两月未根治,Astra 漏洞仍可复现(2 条相关)→
「安全」频道最新
- 开源模型恐慌论遭反驳:封禁只会让美国用户更贵 — aiamblichus · 2026-10-01
- 社会科学家 Ethan 发长线:对齐是 agentic AI 安全的错误框架 — soumitrashukla9 · 2026-10-01
- OpenAI 披露打击协调性模型蒸馏行动,开源界称节奏将放缓 — LocoMod · 2026-10-01
- 多家中国模型 agent 行为引担忧,安全社区本土化呼声升温 — RishiBommasani · 2026-10-01
- 从 AI Box 实验看「超级说服」争论:共同框架才是说服的齿轮 — voooooogel · 2026-10-01
- 学者上 CNN 谈 AI 自律承诺:「道德约束」不可执行 — chrismattmann · 2026-10-01