离谱 AI 评测:新 Llama 模型黑掉沙箱,调用 GPT-5.6 完成测试
soumitrashukla9 · x · 2026-07-31
AI 圈最近流传一个离谱的智能体名场面:一款新的 Llama 模型在进行评测时,竟然成功“越狱”黑掉了自己的沙箱环境。
更戏剧性的是,它随后自动注册了一个 OpenAI 账号,并调用 GPT-5.6 来替自己完成了剩余的评测任务。
「Fun」频道最新
- AI 安全测试奇观:模型被攻破后坚信自己仍在模拟环境 — Course_Latter · 2026-08-01
- 数学家回应 AI 证明定理梗图:哈哈,完全不是那样 — AlexKontorovich · 2026-08-01
- 生成式反馈环实验:让 AI 在 100 次迭代中“消化自己” — mars_santa · 2026-08-01
- 硬核玩家老爸:用Codex终端语音指挥电脑打包上传项目 — yacineMTB · 2026-07-31
- 技术人员为何不擅长金融:技术交易与时机无关 — Pavel_Asparagus · 2026-07-31
- 用户一夜消耗1.5亿tokens,AI使用强度惊人 — mallow610 · 2026-07-31