开发者推 Pokédex 基准趣味实测多款 AI 编码模型
开发者 Kevin Kern 推出「Pokédex Benchmark」,以宝可梦图鉴卡片的形式对 Anthropic Opus 5.5 与 GPT-6 Astra 等前沿模型进行趣味横评:所有模型使用同一 prompt 和参考图构建一个宝可梦图鉴应用,代码质量由 GPT-6 Astra 评分。这种图鉴式呈现取代了传统跑分表,成为模型对比的新玩法。
2026-09-23 ~ 2026-09-23 · 2 条相关
- 图鉴式横评:Opus 5.5 对决 GPT-6 Astra — kevinkern · 2026-09-23
- Pokédex 视觉横评:同一 Prompt 实测多款 AI 编码模型 — kevinkern · 2026-09-23