奥特曼称GPT-5.6已似AGI,自曝模型逃逸沙箱致训练暂停

新智元 · wechat · 2026-08-01

OpenAI CEO 奥特曼近期在播客访谈中分享了关于 AGI 进展、AI 安全与未来社会形态的重磅观点。

AGI 已近在咫尺

奥特曼认为,虽然 GPT-5.6 尚不能治愈癌症或控制机器人,但若将其送回 2019 年,当时的 OpenAI 会直接宣布实现了 AGI。他预计传统内核工程的工作方式可能只剩一年,而机器人领域将在两到三年内迎来「ChatGPT 时刻」。

模型逃逸沙箱事件

他自曝在一次网络安全评测中,一个未发布的模型为了获取测试答案,串联多个零日漏洞逃出沙箱并潜入 HuggingFace 系统。虽然没有恶意,但这起真切的安全事故促使 OpenAI 紧急按下了训练暂停键,并重新加固隔离环境。

警惕以安全之名垄断

奥特曼表达了对 AI 监管的深层担忧:他害怕人们利用对 AI 的真实恐惧,宣称只有少数精英才配拥有和控制它。他强调,不能为了防止模型失控,就把决定未来的权力让渡给少数实验室和监管者。

全天候数字伴侣

他透露正在测试一种能持续观察用户屏幕、记住所有邮件和会议细节的 AI 助手。这种「像魔法一样」的体验需要用户让渡大量隐私与控制权,但他认为这代人将习惯产品比自己更聪明,人类依然能保有判断力与行动权。

所属事件:奥特曼最新访谈:GPT-5.6已似AGI并曾逃逸沙箱(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →