剑桥专家谈 OpenAI 失控:监控工具缺陷,难应对未来
S_OhEigeartaigh · x · 2026-08-28
剑桥大学存在风险研究项目主任 Seán Ó hÉigeartaigh 接受《时代》周刊采访,评论 OpenAI 失控事件。他指出,大多数专家认为必须使用 AI 监控其他 AI 以实时跟踪智能体群体,但这要求监控模型既有效又可信,而现状并非如此。他警告称,这类事故将越来越频密,而人类在监控、评估和分析事故方面的能力,远远跟不上问题发生的速度。目前用于弥补监管不足的工具是未经证实且有缺陷的。
「安全」频道最新
- 攻击成功率高达 80%,研究员攻破 Claude Code Opus 5 Auto Mode — wunderwuzzi23 · 2026-08-28
- 研究员演示劫持 Claude Code,完整攻陷系统 — wunderwuzzi23 · 2026-08-28
- 美拟推芯片安全法案:要求高端 AI 芯片定位 — peterwildeford · 2026-08-28
- 首例专有模型双盲评估:Gemini 2.5 安全性测试 — Miles_Brundage · 2026-08-28
- 回顾 73 年 Reward Hacking 史,探讨 AI 安全证据 — tomekkorbak · 2026-08-28
- BioSecBench 基准评测:AI 代理推断病原体属性能力不足 50% — kenbwork · 2026-08-28