延迟三个月才公开:业界质疑 Anthropic AI 安全事件披露机制
andreisavu · x · 2026-08-01
针对 Anthropic 近期披露的一起 prompt injection 安全事件,行业专家表达了强烈质疑。评论认为,业界天天强调对齐,却在检测与隔离上严重失职。
该事件引发了关于 Anthropic 披露动机的争议,外界猜测其是否存在以下问题:
- 不透明:事件早在 4 月就发生,却选择现在才分享;
- 能力不足:长达 3 个月未能察觉攻击;
- 别有用心:翻出从未公开过的旧事故,可能带有特定的议程或公关目的。
「公司和人」频道最新
- 宝洁与 OpenAI 研究均显示:AI 正在打破企业内部岗位边界 — emollick · 2026-08-01
- 前 OpenAI 核心成员 Igor 创办本地 AI 公司,称闭源大厂正受挤压 — ibab · 2026-08-01
- Cohere Labs 免费 ML 暑期学校登顶 Twitch 科技区 — cohere · 2026-08-01
- 用AI替代中层管理:创始人应将战术性追踪工作自动化 — ycombinator · 2026-08-01
- Leonardo.AI 创始成员宣布从 Canva 离职 — johnowhitaker · 2026-08-01
- 汤森路透自研大模型跻身全球顶尖行列 — Cynddl · 2026-08-01