xAI 工程师:Grok 4.7 已够强,瓶颈在 agent 可靠性

elonmusk · x · 2026-09-28

xAI 工程师 Larsen 转发并展开谈加入后的观察:用户反馈几乎没人要求「让 Grok 更聪明」,而是抱怨 agent 干不完活——做到一半停下、丢失浏览器状态、忘记上下文、卡住干等用户。

他认为这说明模型已不是瓶颈,真正欠缺的是 harness 层的可靠性:工具调用、浏览器、记忆、状态管理、重试与错误处理,每一步都可能让 agent 失败。他透露正在着手解决这些问题。马斯克转发了这条帖子。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →