DeepMind 新智能体零输入解决数学猜想,自动防幻觉

thisguyknowsai · x · 2026-08-22

Google DeepMind 发布了一篇关于自验证智能体的论文,提出了名为 Aletheia 的系统,能够在生成时捕捉自身的幻觉。该系统已在无人干预的情况下自主解决了 4 个开放的 Erdős 猜想,并撰写了一篇可发表的数学论文。

核心洞察在于:生成解决方案的模型并不擅长发现自身的错误,因为导致幻觉的权重同样用于评分,这也是为什么“让模型自我检查”往往效果不佳。Aletheia 将任务分解为三个相互沟通的子智能体:

循环运行直到验证器签字通过。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →