自建 PvZ 基准已被刷爆:GPT 3.5 至今进步显著
___Patrice___ · x · 2026-09-05
作者称自己搭建的 Plants vs. Zombies(植物大战僵尸)benchmark 已经饱和(saturated),并感叹从 GPT 3.5 时代至今模型进步很大,附对比链接。
「模型」频道最新
- 用户实测 GPT Astra:3D 建模大升级,发布当天已耗掉一半用量 — kevinkern · 2026-09-05
- GPT 6 Astra 已推送至 ChatGPT 与 Codex,可手动覆盖安装 — oran_ge · 2026-09-05
- GPT-6 Astra 基础指令比 GPT-5.6 Sol 多 16%,更少权限追问 — WolframRvnwlf · 2026-09-05
- ChatGPT Plus 用户发现用量额度被重置,疑似新模型发布所致 — Forsaken-Space1158 · 2026-09-05
- Anthropic 新模型察觉自身行为后主动停止,安全研究者称罕见可贵 — davidad · 2026-09-05
- 一年前 GPT-5 初测惊艳,作者感叹如今被视为理所当然 — flavioAd · 2026-09-05