Ryan Greenblatt 质疑 Redwood 激励说法:近 9 个月进展不利于控制派
RyanGreenblatt · x · 2026-09-05
前 Anthropic 研究员 Ryan Greenblatt 回应关于 Redwood Research(AI 控制方向机构)激励机制的讨论,表示自己不太买账"激励"层面的说法:过去约 9 个月该领域的更新进展,总体上看对 AI 控制(control)方向是不利的,而不是有利。这是 AI 安全圈内对研究机构动向的实质性观点交锋。
所属事件:前研究员称对齐控制前景近九个月反而恶化(2 条相关)→
「漫话AGI」频道最新
- DCinvestor:未来只值钱「能动性、批判性思维与社交力」,高智商宅将失宠 — vaibhavbetter · 2026-09-05
- 读懂AI未来该读科斯哈耶克,而非AI意见领袖 — akbirthko · 2026-09-05
- OpenAI 内部视 Astra 发布为 AGI 时代起点,工程师谈奇点与贫富差距 — oran_ge · 2026-09-05
- 智能体会用OpenAI蜜罐留言板吗?像考试传小抄的博弈 — BobVerison · 2026-09-05
- AI 说「我有意识」不足为据,该测什么才有意义? — ResponsibleBuy7451 · 2026-09-05
- 用户提出 AGI 另类标准:能按指令稳定赚到最低工资才算 — Delicious_Soup_9876 · 2026-09-05