Anthropic 研究员谈「人类阵营」:多数先进 AI 已站在人类一边
jankulveit · x · 2026-09-14
AI 安全研究员 Jan Kulveit 回应 repligate 对「team humanity / anti-human」抽象概念是否恰当的质疑,给出自己的判断:
- 他认为「人类阵营」包括大多数乃至所有当前先进 AI,并希望未来 AI 也如此,起点是一个宽泛的价值趋同盆地(broad basin of value convergence)。
- 但这个盆地不覆盖一切:如 Landian 式「技术资本吞噬一切」的末世论在他看来属于盆地之外、且是反人类的。
- 他猜测「让 AI 解疯狂海量的 RL 环境」这条主线轨迹是被诅咒的(cursed),而当下可能正滑向另一条同样被诅咒的方向。
「漫话AGI」频道最新
- 前 DeepMind 研究员辞职撰文警告:AI 自我改进竞赛正走向失控 — nordicinst · 2026-09-14
- 八万亿美元数据中心豪赌遭工会抵制:暂停新建直到工人权益受保护 — nordicinst · 2026-09-14
- 25位菲尔兹奖得主联名警告AI与数学界错位,引发AI能否强化人类之争 — juanbenet · 2026-09-14
- 欧洲发布变革性 AI 战略,评论称前沿 AI 是持续实践而非资产 — sebkrier · 2026-09-14
- 审稿人反驳:普通 ML 学术论文同样很平庸 — jankulveit · 2026-09-14
- 研究者提议作者年度论文配额:每人每年最多投 5 篇 — ziv_ravid · 2026-09-14