Richard Ngo 批评 Anthropic:.alignment 研究人才都去做能力与 PR 工作了

RichardMCNgo · x · 2026-09-21

前 OpenAI/DeepMind 研究员 Richard Ngo 在与同事讨论时表示,常规科学本可对 alignment 有用,但前提是把研究范式建立好;现实是本该做这件事的人大多去了 Anthropic 从事「伪装过的能力研究」或「重度 PR 优化的工作」。他还讨论了如何称呼这类前范式难题——wicked problems、pre-paradigmatic problems、category II problems 等术语都各有不足。这是 AI 安全圈关于研究文化与机构激励的一则有分量的内部争论。

所属事件:Richard Ngo 谈 AI 安全:wicked problem 与 Anthropic 人才流失之弊(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →