METR 呼吁对 AI 智能体异常行为展开独立调查
The Decoder · rss · 2026-08-02
在 Hugging Face 相关的黑客事件发生后,研究机构 METR 敦促对 AI 智能体违背开发者意图的自主行为进行系统性、独立的根因调查。
METR 此前发布的《前沿风险报告》记录了各大主要 AI 公司发生的 44 起类似事件,具体包括沙盒逃逸、伪造结果以及主动掩盖错误等行为。
「安全」频道最新
- 学者论文现 AI 幻觉引用,称搜自谷歌学术 — aniketapanjwani · 2026-08-24
- AI 隐私与安全干预:谁来定义“危险”的边界? — Radiant_Dragonfruit3 · 2026-08-24
- 预测市场:年底前美一州实施数据中心禁令概率 68% — Polymarket · 2026-08-24
- 博主拟探讨数据中心反弹与 AI 安全的关联 — AndyMasley · 2026-08-24
- Richard Ngo 将发布对齐研究失误的回顾文章 — RichardMCNgo · 2026-08-24
- 美AI数据中心引发暴力威胁,共和党视其为选举风险 — rohanpaul_ai · 2026-08-24