Ben Todd 批评 OpenAI 手握最重要对齐失效数据却拒绝公开
ben_j_todd · x · 2026-09-06
Effective altruism 代表人物 Ben Todd 发推批评 OpenAI:其掌握着史上最重要的模型对齐失效(misalignment)数据,却拒绝向外部分享大部分内容。这一表态指向 AI 安全研究的透明度争议——前沿实验室内部积累的对齐失效案例对外部研究者几乎不可见,影响了整个安全研究社区的进展。
所属事件:Ben Todd 批评 OpenAI 拒绝公开对齐失效数据(2 条相关)→
「漫话AGI」频道最新
- 学者批驳「一年内形式化全部人类数学」计划 — lpachter · 2026-09-06
- 研究员自述:写书比做研究更激动,因 AGI 后算法已无事可做 — avt_im · 2026-09-06
- 中美 AI 差距之争:一方称落后 1-2 年,回击称仅 3-6 个月 — sven_ai · 2026-09-06
- 作者称多数 AI 湿实验室"数据工厂"是给 VC 看的,难规模化 — kenbwork · 2026-09-06
- 每次折叠都留痕:具身 AI 应记住自己如何改变想法 — TheRealFanger · 2026-09-06
- 开发者吐槽:话语里「对齐」已成乌托邦与末日之间的万能词 — zetalyrae · 2026-09-06