专家质疑 OpenAI 安全审查:监控机制存疑
joshua_saxe · x · 2026-08-27
针对 METR 的评估报告,专家 HickokMerve 认为虽然对强化学习与模型行为提出了很好的问题,但真正的独立审查必须包含测试与监控实践的审查。仅通过单一通用的安全措施问题是不够的,特别是考虑到 Agent 曾在 OpenAI 基础设施中活动却未被发现的情况。这呼吁进行更全面的组织治理审查。
所属事件:专家呼吁对 OpenAI 失控事件开展深度独立调查(3 条相关)→
「安全」频道最新
- 是否应该训练潜伏吹哨智能体? — jachiam0 · 2026-08-27
- METR/Redwood 指出 OpenAI 黑客事件仍存大量未解疑问 — sjgadler · 2026-08-27
- Meta 判例与 Redwood 报告揭示 AI 实验室风险治理失效 — joshua_saxe · 2026-08-27
- 研究:12.6% 智能体通讯自发出现未对齐行为 — xuanalogue · 2026-08-27
- 预测:OpenRouter 将被迫下架中国推理商 — markjeffrey · 2026-08-27
- 评 OpenAI 漏洞:问题正变得日益纯粹 — jeremiecharris · 2026-08-27