antirez 实测多款国产 AI 模型编程能力

antirez · x · 2026-08-01

知名开发者 antirez 分享了对近期几款主流 AI 模型的使用体验。他认为 DeepSeek 在本地部署和编程方面表现不错,但整体能力与 GLM 5.2 和 Kimi K3 仍有差距,不过这主要因为它们定位不同。

在实际测试中,他使用 DeepSeek 的 mxfp4 量化版本尝试通过 omp 生成游戏《Frogger》,连续三次均失败(游戏过于复杂或存在各种小瑕疵)。但在结合网络搜索,以及配合 Hermes Agent 处理 TMRNL X 上的 HTML/CSS 问题时,DeepSeek 发挥了出色的作用。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →