研究者激辩:代码训练与物理能力如何影响 AI 灾难风险

AI 安全领域近日展开一场对齐争论:Josh Purtell 认为若模型从未在代码数据上训练,真正的网络灾难将难以发生,因为失对齐 AI 需要多个依赖强泛化能力的环节全部打通才能成灾。lusichu 则反驳「现在做不到就不用担忧」的论调,指出已有一批初创公司在尝试让 AI 获取物理世界能力,且能力扩展速度常被低估,真正危险的 AI 恰恰应具备自我合成和引导物理能力的本事。

2026-09-14 ~ 2026-09-14 · 2 条相关