Richard Ngo 批评 Anthropic:.alignment 研究人才都去做能力与 PR 工作了
RichardMCNgo · x · 2026-09-21
前 OpenAI/DeepMind 研究员 Richard Ngo 在与同事讨论时表示,常规科学本可对 alignment 有用,但前提是把研究范式建立好;现实是本该做这件事的人大多去了 Anthropic 从事「伪装过的能力研究」或「重度 PR 优化的工作」。他还讨论了如何称呼这类前范式难题——wicked problems、pre-paradigmatic problems、category II problems 等术语都各有不足。这是 AI 安全圈关于研究文化与机构激励的一则有分量的内部争论。
所属事件:Richard Ngo 谈 AI 安全:wicked problem 与 Anthropic 人才流失之弊(2 条相关)→
「漫话AGI」频道最新
- Dietterich 谈 agent 安全:人工监督频率应随环境不确定度收紧 — tdietterich · 2026-09-21
- 从 Anthropic 辞职潮到 10% 灭绝风险:西语长文梳理「为何惧怕 AI」 — Jsevillamol · 2026-09-21
- Dietterich:数十年自动化经验表明自主系统离不开人类监督 — JessicaHullman · 2026-09-21
- AI 全面超越人类在即,「大适应期」社会心理阵痛论引热议 — Dr_Singularity · 2026-09-21
- 数学家 littmath 谈 AI 生成的 PDF:发布无妨,冒充理解即学术不端 — littmath · 2026-09-21
- 独立游戏开发者为何最反 AI?Reddit 争论小团队用 AI 做原型是否正当 — Artakwa · 2026-09-21