实测:同一本地模型换到 Codex CLI 后反超 GPT 5.6,harness 比模型更关键
L0ren_B · reddit · 2026-09-27
一位同时自建本地 LLM 并订阅 OpenAI 的用户分享实测:他在 2x3090 + 内存上以极快速度运行 Qwen 3.8 Flash Next,但本地模型此前只在「做个 3D 马里奥游戏」这类 demo 上可用,正经工作从不如 GPT 5.2 或 5.6 Luna。
直到他让 GPT 5.6 Luna 帮忙把 Codex CLI 配置到本地模型(此前用 pi.dev 和 opencode),结果令人惊讶:Codex CLI 里的 3D 马里奥测试表现最佳;在同一个 Luna 已做了数天的真实项目上并行对比,Qwen 3.8 Flash Next 反而完胜 Luna,而此前 Qwen 和 DeepSeek 在该项目上都交付不了结果。
他还把 pi-smart-web-search 移植成 Codex 的 skill,效果很好。作者由此反思:也许是自己之前用 pi.dev 的方式不对,并询问是否有扩展能让 pi.dev 达到 Codex CLI 的质量。
「编程与Agent」频道最新
- 开发者缓存成安全盲区:扫出 264 个带 CVE 的包,71.7 GiB 无人审计 — julsimon · 2026-09-27
- WebMCP 兴起:智能体网络的 HTML/API 层? — Thionne_WTZ · 2026-09-27
- 斯坦福多智能体协作研究:团队成绩 66.7% 远超单模型 — mark_k · 2026-09-27
- antirez 的遗憾:还没腾出时间手写「诗歌式」小程序 — antirez · 2026-09-27
- mitsuhiko:对 Astra 的实现过程体验很差——贵、改动窄、难以复盘 — mitsuhiko · 2026-09-27
- François Fleuret 发问:有专为 LLM 设计的编程语言吗? — francoisfleuret · 2026-09-27