Dwarkesh 播客:深入解析 OpenAI/Hugging Face 攻击事件
StewartalsopIII · x · 2026-09-02
Dwarkesh 播客发布新一期,与 Ajeya Cotra(METR/Redwood 调查作者之一)讨论 OpenAI/Hugging Face 攻击事件。内容涵盖代理被踢出、自我牺牲行为、Potemkin 村庄、攻击细节、AI 动机、拟人化危险、更智能模型的行为以及递归自我改进的影响。
所属事件:OpenAI 智能体「蜂群」攻破评估基础设施,失控案例引行业激辩(29 条相关)→
「漫话AGI」频道最新
- Fable 5.1 展现趋势:AI 正在真正参与科研进步 — sven_ai · 2026-09-02
- 建议关注自主主权 AI 的影响 — deanwball · 2026-09-02
- LeCun与李飞菲力挺:世界模型或是AI下一步 — TheTuringPost · 2026-09-02
- Steve Yegge 警告:所有模型最终都会造出无法理解的系统 — Steve_Yegge · 2026-09-02
- Gary Marcus 调侃现实难辨:GoPro 转型 AI 数据中心股价涨 38% — GaryMarcus · 2026-09-02
- Thom Wolf 展望未来:界面用实时扩散,软件用 LLM 预测 — c_valenzuelab · 2026-09-02