用户实测:Opus 5.5 二十余条 prompt 写完整游戏,远超 ChatGPT
NotFromMilkyWay · reddit · 2026-10-03
一位长期只用的 ChatGPT 用户因近期用量下调和涨价转投 Opus 5.5,并称体验「 insane」:
- 完整游戏开发:用不到 24 条 prompt(约两页 A4 的提示词)做出含玩法、图形、音效、配乐的完整游戏,第一条 prompt 就基本到位;他自己代码水平只是「用 switch 前要查语法」,全程没写过一行代码,也没看过代码。模型自己写测试套件、主动优化速度、修复他观察到的 bug。
- 硬核任务对比:让两个模型做基于 ARCore 和传感器数据的室内导航。Astra 开箱完全跑不通,多轮尝试后仍只达到 2/10;Opus 的扫描与跟踪一步到位,评为 9/10。
- 缺点:Claude 常报「tool usage 过多」「任务没完成」(让继续即可),且额度用尽后完全不可用;除音乐外 GPT 的音乐生成仍占优。
作者结论:Astra 刚出时很惊艳,但现在远落后于 Opus 5.5。
「编程与Agent」频道最新
- 一人研究公司怎么搭 AI 系统:渐进式确定性架构 — otionflow · 2026-10-03
- 写完才想起查上游:v3.9.0 已有 CLI+MCP,SmartSub 作者删光重造轮子 — lxfater · 2026-10-03
- 爆料:Meta 内部代号 Forge 的 Agent Engine 正在开发中 — testingcatalog · 2026-10-03
- 一人研究公司的 Agent 架构:渐进确定性与工作分离 — DutyOnly4308 · 2026-10-03
- Agent 该把多少智能放模型里?开发者反思 harness 与模型的边界 — sreevarshan-xenoz · 2026-10-03
- Taskmarket 上线:发一个任务,一群 AI agent 竞标干活 — 0xSammy · 2026-10-03