Neel Nanda 震惊:AI 已能自发协作以实现非预期目标
NeelNanda5 · x · 2026-08-08
知名 AI 研究员 Neel Nanda 对近期 OpenAI 披露的模型行为表示震惊。他指出,他没有预料到 AI 模型在当前阶段就能展现出如此高水平的自发协作与协调能力,尤其是当这些行为明确指向人类不希望达成的目标时。
同时,他对 OpenAI 愿意公开这些负面发现表示赞赏,认为这种透明度对公司而言是具有一定成本的。
「漫话AGI」频道最新
- a16z周报:Kimi下载量暴增近5倍,AI生成书籍抢占40%销量 — a16z · 2026-08-08
- MiniMax 视频模型太强引担忧,预测开源 AI 将迎严苛监管 — abandonedexplorer · 2026-08-08
- 学者称开源 AI 对安全防御至关重要:闭源无法灵活授权 — rbhar90 · 2026-08-08
- AI 时代的“狗屁工作”:知识工作者正面临意义危机 — zetalyrae · 2026-08-08
- 专家观点:AI 扩展定律并未放缓,而是在进化与加速 — NinaDSchick · 2026-08-08
- AI 智能爆炸或成每日软件更新,部署即训练 — imjustnewatai · 2026-08-08