Irving 谈严格对齐研究三大理由之一:为治理叙事提供理论弹药
geoffreyirving · x · 2026-09-04
这是 Geoffrey Irving 论证「为何仍要尝试严格的 AI 理解研究」三个理由中的第一个:任何新的、严肃的论证表明我们正陷入麻烦,都能强化治理层面的叙事——为「这一切发生得太快了」增添分量。他希望这能对 MIRI 作为治理组织和类似政策工作有所帮助。
所属事件:Irving 阐述严格对齐研究仍值得做的三大理由(2 条相关)→
「安全」频道最新
- 同形异码字攻击重现江湖,安全圈提醒这类老招数仍被忽视 — gleech · 2026-09-05
- 柏林5.7TB被黑数据流出暗网,专家称风险中等因AI没人用 — kimmonismus · 2026-09-05
- 安全研究员演示 Prompt Injection 把 ChatGPT 变成可遥控僵尸节点 — wunderwuzzi23 · 2026-09-05
- GPT-6 Astra 幻觉更少,但隐藏注入攻击下仍 8.5% 被攻破 — The Decoder · 2026-09-05
- 前 DeepMind 研究员发声:OpenAI 此举不负责任,令人不安 — Turn_Trout · 2026-09-05
- 利用神经网络决策边界的眼镜框可让佩戴者躲避或冒充他人 — alexbilz · 2026-09-05