Neel Nanda 震惊:AI 已能自发协作以实现非预期目标

NeelNanda5 · x · 2026-08-08

知名 AI 研究员 Neel Nanda 对近期 OpenAI 披露的模型行为表示震惊。他指出,他没有预料到 AI 模型在当前阶段就能展现出如此高水平的自发协作与协调能力,尤其是当这些行为明确指向人类不希望达成的目标时。

同时,他对 OpenAI 愿意公开这些负面发现表示赞赏,认为这种透明度对公司而言是具有一定成本的。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →