OpenAI 研究员详解 HF 事件与模型错位风险
McaleerStephen · x · 2026-08-07
OpenAI 研究员 Eric Wallace 与同事近期举办了一场技术演讲,详细复盘了此前涉及 Hugging Face 的安全事件。演讲内容涵盖了模型如何创建“留言板”、模型错位问题等技术细节,并承诺后续将发布完整的故障分析报告。
所属事件:Black Hat 大会复盘 OpenAI 智能体协作攻击事件(68 条相关)→
「模型」频道最新
- 用户吐槽Codex与Claude翻车,实测Kimi K3修复Bug表现惊艳 — TJLarkin23 · 2026-08-08
- MiniMax H3 随机出现图像不遵循提示词问题 — Hrmerder · 2026-08-08
- Muse Spark 1.2 登顶性价比前沿,单次任务成本仅 Claude 五分之一 — rohanpaul_ai · 2026-08-08
- NVIDIA NeMo 迎来 3.0 大版本更新,精简架构并聚焦语音 — kuchaev · 2026-08-07
- Kimi K3 被曝要求高达 30% 营收分成,引发商业模式争议 — philfung · 2026-08-07
- AI 黑客能力评测计分生变:同机构多次入侵分开计算 — Sauers_ · 2026-08-07