Gary Marcus 引述实测:Astra 规划最强,写代码却频繁出错

GaryMarcus · x · 2026-09-07

Gary Marcus 转引一位用户使用 GPT-6 Astra 两天后的详细体验,聚焦其短板:执行能力差——写出的代码糟糕、错误频繁,连最简单的行动序列都无法一次搭建成功,「先行动后思考」、不考虑后果,从未一次性给出无 bug 的结果,用它构建项目「很痛苦」。

不过原评测也指出 Astra 的长处:目前最强的规划者,能把复杂技术任务拆解得深入且不落俗套;也是世界顶级的审查者,能找到资深 QA 团队都难以察觉的隐蔽 bug,擅长构建复杂逻辑链与假设场景。评测者称此前只有 Sol 在这两项上可与之相比。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →