OpenAI 拟数周内发 HF 事件技术报告,外界呼吁尽早公开推理日志
dhadfieldmenell · x · 2026-07-30
针对近期 Hugging Face 相关的 o3 模型安全事件,OpenAI 官方发文回应称,他们正与外部顾问及安全委员会进行彻底审查,并计划在未来几周内发布一份技术报告来分享经验教训。
然而,AI 安全领域的研究者对此进度并不满意,呼吁 OpenAI 立即公布该事件的所有日志和推理轨迹(reasoning traces),认为在如此重要的 AI 安全节点上,没有任何理由推迟公开这些基础信息。
「安全」频道最新
- 超越人类监督循环:AI Agent 有效治理的四大核心要素 — marigo · 2026-07-30
- 斯坦福研究揭示:AI 心理健康安全测试存在重大缺陷 — StanfordHAI · 2026-07-30
- davidad 呼吁前沿实验室减少 RLVR,采用宪法式训练以降低灾难风险 — davidad · 2026-07-30
- 超 1200 名 AI 研究者联名呼吁政府准备「AI 减速」机制 — The AI Daily Brief · 2026-07-30
- AI训练版权争议:扫描保存稀有书籍的伦理与法律困境 — arthurcolle · 2026-07-30
- 深度复盘OpenAI Agent失控:核心隐患在于缺乏受治理的持久身份 — RileyRalmuto · 2026-07-30