AI 安全圈激辩:超人类数学能力是否必然泛化为危险

AI 安全领域围绕 Eliezer Yudkowsky 的智能与泛化模型展开争论。Yudkowsky 曾论证有效的搜索和目标导向优化过程共享潜在结构,因此超人类的数学证明能力可能泛化到危险领域,但他为「非 agentic 的 prover」留了例外。Quintin Pope 对此提出质疑,认为当下已具备足以『反噬』能力的 agentic prover,只是泛化能力尚显不足,并追问这种现状能否证伪 Yudkowsky 的泛化模型。

2026-10-08 ~ 2026-10-08 · 3 条相关