工程师出身后奥米特警告:RLVR 扩大千倍在对齐上是真危险

joshua_saxe · x · 2026-09-30

Joshua Saxe(前 Palantir 首席 AI 科学家)提出一个较少被讨论的对齐观点:

这一观点把对齐风险的关键从"能力来源"转移到"优化信号是否可验证"上,值得对齐研究者回应。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →