Burkov:连续 3-5 轮修图改不动,才算测出前沿 AI 真实力

burkov · x · 2026-10-05

机器学习知名作者 Andriy Burkov 提出一个另类的「AGI 试金石」:别看写代码——那是不泛化的特例,真正的检验是交互式图像编辑,即用户通过多轮追加 prompt 提出修正请求。

他的标准很直白:如果连续 3-5 轮修正指令后你还没想把键盘砸了,那才配叫 AGI。言下之意是当前多模态模型在「听懂反馈并准确修改」这类需要理解意图、精细控制的任务上,体验仍然远逊于编码等已被验证的强项。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →