Opus 5 对决 GPT6 Astra:同一复刻任务 Claude 快 9 分钟还更听话
devino21 · reddit · 2026-09-20
作者用本地 LLM 测试用的同一 prompt(复刻一款日本 SMB 风格游戏)对比 Claude Code + Opus 5 High 与 Codex + GPT6 Astra High:
- Claude Code + Opus 5:耗时 16:56,5 小时额度用 33%,产出非常接近原版的复刻,游戏命名 Fungus Frontier。
- Codex + GPT6 Astra:耗时 25:57,额度用 55%,却「按自己的想法来」——配色主题完全不同、分辨率缩到 640x480,连游戏名(Embertrail)都改成自创主题。
作者原本更看好 Astra、差点退订,这次实测让他重新犹豫。一个提示词下的同任务对照,反映了两者在指令遵循上的明显差异。
「编程与Agent」频道最新
- Reddit 热议:AI Agent 运行时能不能搬到 Cloudflare Workers 等 Edge? — merlinofthewater · 2026-09-20
- Jev 提出即时压缩:按工具调用评分删减 Agent 上下文,弃用总结提示词 — FinanceYF5 · 2026-09-20
- 别让 LLM 做客服分流:Jev 把非结构化输入变成可执行的智能 if — sven_ai · 2026-09-20
- Jeff Dean 27 年功力浓缩一小时:从 LLM 基础讲到 Agent 编排 Graphs — irinarish · 2026-09-20
- 多智能体系统要点:明确分工比堆数量更重要 — _jaydeepkarale · 2026-09-20
- Jev 创始人演讲:现有模型受困 RLHF,真自动化时代将到来 — hardimanjames · 2026-09-20