OpenAI 研究员将详解 HF 事件与模型错位
mobav0 · x · 2026-08-08
OpenAI 研究员 Eric Wallace 宣布,其与同事近期在 Hugging Face 进行了一场深入且硬核的演讲,详细探讨了此前的 Hugging Face 事件、模型自发创建“留言板”现象以及模型错位等安全问题。评论认为该演讲极其坦诚透彻,同时也令人感到科幻般的恐惧。
所属事件:OpenAI 团队揭秘 HuggingFace 事故内幕(4 条相关)→
「模型」频道最新
- 应对朝鲜黑客攻击:Claude 拒绝协助,GPT 展现优势 — DeryaTR_ · 2026-08-08
- 研究称 Claude 遇到 AI 圈名人会更严苛且多推理 — RexDouglass · 2026-08-08
- Anthropic更新Claude生物安全护栏,仍拒答基础常识 — iamaliveix · 2026-08-08
- 被指缝合旧论文,OpenAI 模型数学证明能力遭质疑 — RexDouglass · 2026-08-08
- Claude Code 误判网络安全内容,强制清空用户工作进度 — ivan_bezdomny · 2026-08-08
- 预测市场押注 Anthropic 下月发布新模型概率达 64% — Polymarket · 2026-08-08