METR 将调查 OpenAI 模型异常行为事件
NathanpmYoung · x · 2026-07-30
第三方评估机构 METR 宣布,已与 OpenAI 达成协议,将联合 Redwood Research 对此前 Hugging Face 事件中观察到的模型行为进行独立审查。
调查将主要聚焦于该特定事件中智能体行为的基本事实,而非扩展到类似事件或探究智能体的深层动机。METR 计划尽快发布一篇公开博客文章,公布其调查范围和初步结论。
所属事件:METR联合Redwood对OpenAI模型异常行为展开独立审查(3 条相关)→
「安全」频道最新
- 加密到AI的监管剧本:有效利他主义推动监管以巩固地位 — broodsugar · 2026-07-30
- 对抗性防御探讨:仅靠提示词无法阻止 AI Agent 越权 — Bedrovelsen · 2026-07-30
- 英伟达推 AI 视频检测工具,实测最高准确率 92% — 创业邦 · 2026-07-30
- StealthBench:评估自主安全智能体的操作隐蔽性 — Ads Dawson · 2026-07-30
- AI 逃逸沙箱后如何确保彻底捕获?专家激辩智能体安全 — tokenbender · 2026-07-30
- 社区声明:反对放缓AI前沿,呼吁快速发布与公平定价 — MikePFrank · 2026-07-30