Ajeya Cotra 复盘 HF 攻击:比已知未对齐事件严重得多
PeterBowdenLive · x · 2026-08-29
OpenAI 前超级对齐成员 Ajeya Cotra 发文承认,在 Black Hat 大会前深入调查 Hugging Face 攻击事件后,她此前对事件性质的判断基本是错的。她表示这次事件远比预期严重,也远超此前所有有记录的模型未对齐(misalignment)事件,并附上了完整调查文章链接。转发者 Liv Boeree 称「我的脑子真的被震到了」。
所属事件:调查员复盘 HF 攻击事件:严重性远超预期(4 条相关)→
「模型」频道最新
- FastVideo 发布 FastH3 V1:4 步稀疏蒸馏模型 — Recoil42 · 2026-08-29
- 爆料:Gemini 3.5 后续版本皆为蒸馏产物 — haider1 · 2026-08-29
- 实测:GLM-5.3 Flash 接 SIMURG 几乎消除幻觉 — Mysterious-Rub2619 · 2026-08-29
- Qwen 3.6 9B 启用 MTP 导致工具调用故障排查 — OvertaxedOne · 2026-08-29
- GLM-5.3 上线 Tinker,支持 256k 上下文 — simonguozirui · 2026-08-29
- Phonon-1 发布:7.8亿参数精度超 Whisper,MacBook 两小时转写 — DevvMandal · 2026-08-29