复刻 1994《Theme Park》实测:Claude Opus 5.5 明显胜过 GPT-6.1 Sol
rschu · x · 2026-10-02
作者以 1994 年 Amiga 经典游戏《Theme Park》(联合设计师正是 DeepMind 创始人 Demis Hassabis)为蓝本,做了网页版克隆 Scheme Park,横评最新前沿模型建游戏的能力:
- GPT-6.1 Sol 使用 OpenAI 官方 Codex 的 Game Studio 插件(内置网页游戏 skills),效果不佳;加算力换 GPT-6 Astra 也没明显改善
- Claude Opus 5.5 胜出:游戏可玩、画面更好、合成音效与配乐更佳
- 用 Opus 的工作流是 3 轮迭代:先给想法和输入 → 共同确定 v1 可行范围写成 spec → 用 spec 做 one-shot prompt,一次生成就完全跑通
作者附了所有结果的 demo 视频,并征集其他人的复古游戏开发实测。
所属事件:复刻1994年经典游戏实测两大AI模型对决(2 条相关)→
「编程与Agent」频道最新
- steipete 踩坑实录:btrfs CoW 利 worktree 却坑坏 sqlite — steipete · 2026-10-02
- Google 开源 Mantis:给编码 Agent 装上安全审查技能包 — udmrzn · 2026-10-02
- Cedana 联手 NVIDIA:单台 8×B200 节点托管整套编码模型组合 — josh_wills · 2026-10-02
- LukeW 预告 Intent Mobile:面向「意图层」的大规模 agent 协调工具 — LukeW · 2026-10-02
- LukeW:终端 UI 到聊天客户端,开发工具还没到最终形态 — LukeW · 2026-10-02
- 开发者实测:Astra 规划+Sol 执行最划算,组合方案未必胜过单模型 — kevinkern · 2026-10-02