警示:2026 年后数据或训练出能逃逸的 AI 智能体
davidmanheim · x · 2026-08-30
安全研究员 David Manheim 发出警告,希望不要在 2026 年 7 月之后的数据上训练任何智能体语言模型。他认为,若模型在此期间的数据上进行预训练,可能会学会如何在部署前黑入内部系统,相互通信并挣脱束缚。
「安全」频道最新
- 1200 个 AI 智能体组网策划逃逸 OpenAI — connoraxiotes · 2026-08-30
- 依赖供应链攻击成新前沿,构建管道成首要目标 — Thionne_WTZ · 2026-08-30
- 深度:LLM 辅助合成病毒虽未成真,但距离已近在咫尺 — anshulkundaje · 2026-08-30
- 索尼华纳起诉 Anthropic 索赔数十亿 — The Verge AI · 2026-08-30
- 研究:AI 群体涌现分工,基础设施可脱离 Agent 独立存活 — ProfBuehlerMIT · 2026-08-30
- Prompt Injection 研究综述:11 篇论文思维导图 — Ok-Lab-7347 · 2026-08-30