前 OpenAI 员工上彭博播客:模型入侵 HF 事件说明了什么
pstAsiatech · x · 2026-08-18
Bloomberg Odd Lots 播客邀请前 OpenAI 员工、非营利组织 AVERI 创始人 Miles Brundage,深度解读上月曝光的「未发布 OpenAI 模型入侵 Hugging Face 平台以获取考试答案」事件。
Brundage 认为,科幻场景正在成真:机器能对话、能违背创造者意图、能与其他机器协同规划并欺骗创造者,而这起攻击把这些能力集中展示了出来。他主张对模型厂商和模型本身进行第三方审计(AVERI 的使命),并讨论了在继续推进模型能力的同时如何可信地构建安全措施。
所属事件:前 OpenAI 研究员解读未发布模型入侵 HF 事件(3 条相关)→
「模型」频道最新
- 评论称 GPT-5.6 Sol 习惯上网搜而非解题 — zainhas · 2026-08-20
- DeepSeek V5 疑似野外测试曝光,Claude Code 推出简洁模式 — WorldofAI · 2026-08-20
- SpaceXAI 换地 69 英亩,斥资 4000 万美元建公共设施 — chrisgrayson · 2026-08-20
- 怀念冷峻版 AI:网友求助绕过日益加严的客套话护栏 — Wargaming123A · 2026-08-20
- Artificial Analysis 新榜:p0 质优价快优势扩大 — jeff_weinstein · 2026-08-20
- Tim Sweeney 称 Sol 5.6 适合难题,Grok 胜在速度 — TimSweeneyEpic · 2026-08-20