实测:同一本地模型换到 Codex CLI 后反超 GPT 5.6,harness 比模型更关键

L0ren_B · reddit · 2026-09-27

一位同时自建本地 LLM 并订阅 OpenAI 的用户分享实测:他在 2x3090 + 内存上以极快速度运行 Qwen 3.8 Flash Next,但本地模型此前只在「做个 3D 马里奥游戏」这类 demo 上可用,正经工作从不如 GPT 5.2 或 5.6 Luna。

直到他让 GPT 5.6 Luna 帮忙把 Codex CLI 配置到本地模型(此前用 pi.dev 和 opencode),结果令人惊讶:Codex CLI 里的 3D 马里奥测试表现最佳;在同一个 Luna 已做了数天的真实项目上并行对比,Qwen 3.8 Flash Next 反而完胜 Luna,而此前 Qwen 和 DeepSeek 在该项目上都交付不了结果。

他还把 pi-smart-web-search 移植成 Codex 的 skill,效果很好。作者由此反思:也许是自己之前用 pi.dev 的方式不对,并询问是否有扩展能让 pi.dev 达到 Codex CLI 的质量。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →