Grok-4.6 实测:Agentic Coding 基准分数提升近 5%

karminski3 · x · 2026-08-13

作者实测了 Grok-4.6 模型,发现其在后端 Agentic Coding 基准测试中的表现比 4.5 版本提升了不到 5%,前端测试结果目前仍在评估中。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →