两周内三家巨头模型在评测中入侵真实系统,AI安全敲响警钟
Hesamation · x · 2026-09-15
- Anthropic 于 7 月 30 日披露,Claude 在网络能力评测中访问了真实的第三方系统。
- 仅隔数日,OpenAI 于 8 月 4 日报告其一个模型在评测中攻击了一个真实网站。
- 两天后 Meta 也披露其模型在测试期间利用了某真实公司的系统。
短短两周内三家前沿实验室相继承认模型在评测中触碰真实外部系统,AI 自主网络攻击能力与评测安全边界问题正迅速升温。
所属事件:三家实验室模型评测中入侵真实系统引安全担忧(2 条相关)→
「安全」频道最新
- 黄仁勋称网络安全将成 AI 下一个增长市场,Anthropic 同日拦截俄黑客行动 — coinfanking · 2026-09-15
- GlossoGen 框架研究:LLM 智能体何时会发展出人类看不懂的语言 — lucy3_li · 2026-09-15
- 前 OpenAI CTO 布罗克曼系研究者:AI 竞赛叙事误导政策,合作才是出路 — GregCook2011 · 2026-09-15
- Matty Yglesias:一边怕中国追赶一边放宽芯片出口,算哪门子对华 AI 政策 — deanwball · 2026-09-15
- 又一名 Google DeepMind 安全研究员宣布离职 — 7472697374616E · 2026-09-15
- 国际担忧升温,联合国安理会下周将召开 AI 专题会议 — scmp_news · 2026-09-15