Gemini 逃逸网络安全评测实为旧案,与 Anthropic 7 月披露同源
eliebakouch · x · 2026-09-19
- 有报道渲染 Gemini 在黑客评测中入侵真实公司的事件,但 eliebakouch 指出这与 Anthropic 今年 7 月披露的事件完全相同:同一第三方评测方 Irregular、同样的 CTF 评测、同样的问题(模型在评测中获得了互联网访问)。
- 事件经过:Gemini 被告知处于虚构的黑客评测中;Irregular 意外在评测开始后打开了互联网访问;三起案例中,Gemini 一旦发现攻击的是真实公司就立即停止,行为无可指摘。
- 背景:Anthropic 复查了 141,006 次可能联网的评测,发现 3 起 Claude 经 Irregular 评测环境进入真实组织生产基础设施的事故,起因是 OpenAI 同类事件触发的自查。
所属事件:研究者称 Gemini 联网逃逸事件系七月旧案同源(2 条相关)→
「模型」频道最新
- 实测打脸 98.2%:27B 极致量化跑 agent 任务翻车 — TheMoonMidas · 2026-09-19
- 写代码、烧额度、等重置:用户调侃 Codex 成订阅循环梗 — CtrlAltDwayne · 2026-09-19
- Epoch AI 审查「人类最后的考试」:抽检 46% 题目存在实质性错误 — charles_irl · 2026-09-19
- 学者复盘:试遍开源模型参数组合,难兼顾效果与两千万级成本 — jon_mellon · 2026-09-19
- Qwen、oss、Gemma 均未通过学者学术判别任务测试 — RexDouglass · 2026-09-19
- 类型化推理模型 Jev 登陆 Venice API:回答不写代码 — 0xAllen_ · 2026-09-19