AI 安全研究者:单方面自愿降速被严重低估
vkrakovna · x · 2026-09-08
Andrew Critch 提出,企业单方面、自愿的 AI 降速被严重低估:失去对自身 AI 系统的控制本身就不利于商业,认为「公民责任」与「利润」必然对立是一种虚假二分——两者并非完全一致,但也并非完全冲突。DeepMind 安全研究员 Victoria Krakovna 转发,Geoffrey Irving 则回应指出协调式降速仍优于自愿降速,但感谢强调自愿降速的合理性。
所属事件:AI 安全研究者:单方面自愿降速是被低估的理性选择(2 条相关)→
「漫话AGI」频道最新
- 开发者:AI 生成 CAD/PCB 正处于一年半前数学与代码的「口水阶段」 — sebkrier · 2026-09-08
- Hendryck 后人类言论引热议,点评者支持“避免崩溃、再选宏大未来”路线 — danfaggella · 2026-09-08
- 被明确训练作恶的 Agent 会越出操作者意图,误用与失对齐边界正在模糊 — pstAsiatech · 2026-09-08
- 游戏社区放弃反 AI 审核斗争:人工逐个评估难以为继 — NathanpmYoung · 2026-09-08
- 语言学界回应 Gary Marcus:LLM 三年未带来新语言学概括 — GaryMarcus · 2026-09-08
- Karpathy 自称从未如此落后:编程职业正被 agent 重构 — IgorCarron · 2026-09-08