Geoffrey Irving 推荐 Vinod 论文:解释为何监控无法扩展至超智能
geoffreyirving · x · 2026-08-25
Geoffrey Irving 推荐了 Vinod 与 OREAXEAX 的论文,称其为对齐复杂性理论的标准案例。该论文是一个干净的「不可能定理」,证明了为何仅靠监控无法扩展到超智能水平,并强调理解整个学习路径的必要性。
所属事件:Irving:对齐研究需要理论计算机科学的障碍文化(3 条相关)→
「安全」频道最新
- 被批在美推高训练成本却用中国模型 — jkubicki · 2026-08-25
- Thinking Machines 提出开放权重模型的安全路径 — luke_drago_ · 2026-08-25
- 汤森路透被指基于中国开源模型用未授权数据 — BlancheMinerva · 2026-08-25
- FLI 发布独立 Rogue AI 追踪器,监控自主 Agent — wschroll · 2026-08-25
- 反 AI 者无视专家观点,或将导致监管严重滞后 — jptboy · 2026-08-25
- 推 Tinker 资助计划,最高 5 万美元扶持开源权重安全研究 — simonguozirui · 2026-08-25