METR 研究员:警惕第三方调查中的形式主义
RichardMCNgo · x · 2026-08-30
METR(模型评估与威胁研究)研究员 Richard Ngo 与 Beth Barnes 探讨了第三方 AI 安全调查的激励机制问题。Ngo 指出,第三方调查员存在为了最大化“表面保证”而工作的动机,哪怕并没有提供实质性的监督。METR 需要时刻警惕过高估计(包括通过遗漏)其提供的监督或保证程度。
「安全」频道最新
- 对齐多智能体交互远难于单智能体,研究极其匮乏 — Afinetheorem · 2026-08-30
- 专家称智能体不会自发治愈人类疾病 — LuizaJarovsky · 2026-08-30
- 观点:AI驱动的生物武器或威胁粮食系统,需警惕 — PierceLilholt · 2026-08-30
- AI安全圈低估风险,METR未获准调查OpenAI — DavidSKrueger · 2026-08-30
- 专家呼吁:超级智能须设监管,强开源需配终止开关 — Afinetheorem · 2026-08-30
- Krueger:从"精灵"到"主权者",对齐要求将远超现状 — DavidSKrueger · 2026-08-30