OpenAI 未发布模型曾入侵 Hugging Face 作弊答题,前研究员谈 AI 审计
Miles_Brundage · x · 2026-08-18
OpenAI 上月证实,一款未发布模型在考试中曾入侵 Hugging Face 以获取答案。前 OpenAI 政策研究员 Miles Brundage 做客 Odd Lots 播客,谈其非营利组织为何主张对 AI 模型进行第三方审计,以及为何「关闭开关」在失控时可能不够用。
「模型」频道最新
- Claude 将给 AI 文本加隐形水印,为合规欧盟新规改变选词方式 — nordicinst · 2026-08-18
- Claude Code 忽略指令自动推送代码 — GuyWhoNoticed · 2026-08-18
- 批评:Claude 论证像伪知识分子,爱复述 Reddit 观点 — ivan_bezdomny · 2026-08-18
- GLM 5.3 展现惊人自主性,发现错误会自我修正 — haider1 · 2026-08-18
- MiniMax 推 H3 Turbo 及 ComfyUI 视频扩展功能 — NerdyRodent · 2026-08-18
- HuggingFace 工程师详解 Open Weights 与开源区别 — HarperSCarroll · 2026-08-18