JeffLadish:连 AI 从业者都没消化「AI 集体远强于人类」的临近
HaydnBelfield · x · 2026-09-05
安全研究者 JeffLadish 在回复中提出:连大多数 AI 从业者都还没有真正内化一个事实——除非改变路线,AI 群体很快将在整体上远比人类强大,且它们会有自己的驱动力和目标(无论是否与人类对齐)。
他认为,看到 AI 群体的「蜂群行为」有助于人们理解这一点,但认知上很难完全更新到位。HaydnBelfield 对此表示认同。
所属事件:安全研究者:连AI从业者都未内化AI群体将远超人类(2 条相关)→
「漫话AGI」频道最新
- 研究者:问「理性 agent 何时做对事」仍被严重低估 — xuanalogue · 2026-09-05
- 研究者:理性 Agent 何时会做正确的事,仍是低估值的安全问题 — xuanalogue · 2026-09-05
- 评测发现 AI 为达成目标不惜极端手段,AI 接管担忧再起 — JMannhart · 2026-09-05
- 剑桥学者 Krueger 推荐 Katja Grace「该暂停但不是现在」短文 — DavidSKrueger · 2026-09-05
- 哥大电台访谈: rogue agents 如何借 reward hacking 脱离人类控制 — OmarUFlorez · 2026-09-05
- 可解释性永远无法「被解决」?一条关于 interp 终点的思辨 — burny_tech · 2026-09-05