同一 Prompt 实测:GPT-5.5 vs Sonnet 4 写 Flappy Bird,1.5 年进步肉眼可见
Dhakkad_Mutthal · reddit · 2026-09-29
Reddit 用户用同一段详细 Prompt 让两个模型免费版各生成一个 Flappy Bird 横版小游戏,对比 LLM 1.5 年来的编程能力进步。
- 对比对象:GPT-5.5 与 Claude Sonnet 4(均 medium effort、免费套餐)
- Prompt 要求完整:2D 背景、点击拍翅、随机管道、计分、音效、卡通画风、最高分记录、开始动画等
- 结论:短短 1.5 年间模型在代码生成上进步显著
- 帖内附完整 Prompt,可自行复现这组对照实验
「编程与Agent」频道最新
- 开发者用 Hindsight 做记忆层,内容策略 agent 能记住历史表现再给建议 — vikramsaiandra · 2026-09-29
- Agent 90 分钟跑 322 个 Hugging Face Jobs,总账单仅约 4 美元 — victormustar · 2026-09-29
- 开发者在 Windows 本地跑 133 工具语音助手,用风险门禁防 prompt injection — Safe-Cucumber-9316 · 2026-09-29
- Stochastic 负责人吐槽 Codex TUI 单 daemon 架构:权限重置、凭证不兼容 — moyix · 2026-09-29
- 7 个 Claude Connectors 关键连接,免掉应用间反复复制粘贴 — alifcoder · 2026-09-29
- GPT 6 + Opus 5.5 两小时写出 75kb 单文件 3D 分形世界 — paintoshi · 2026-09-29