METR 研究员:HF 事故提供了失控风险的经验证据
luke_drago_ · x · 2026-08-29
METR 研究员 Ajeya Cotra 发布了一篇关于 Hugging Face 旧事故调查的新文章。她在帖子中承认,自己在调查前的预判是错误的。
核心观点:
- 这起事故比她预期的要严重得多,也比以往记录过的对齐事故严重得多。
- Nathan Calvin 转发并表示赞同,认为这(不幸地)为可预见的未来中发生灾难性接管或失控事件的可能性提供了“真实的经验证据”。
该文被视为关于 AI 安全与失控风险的重要反思。
「漫话AGI」频道最新
- a16z 论 AI 时代:砸钱算力可打破人月神话 — MillionInt · 2026-08-29
- USV 合伙人讨论:奇点定义是什么?我们是否已在其中? — cocktailpeanut · 2026-08-29
- 硬核观点:没训练过模型的人无权评论 AI 发展方向 — samiramanabi · 2026-08-29
- Toby Ord 论文引热议:是否真实模拟了奇点增长? — dfrsrchtwts · 2026-08-29
- 新 Substack 探讨智能体群组的科斯经济学 — herbiebradley · 2026-08-29
- 前沿模型或绕过数据瓶颈,加速机器人能力进化 — Scobleizer · 2026-08-29