内部评测图比较各模型居中一个 div 要多少 token
BLUECOW009 · x · 2026-07-29
一张内部评测图在比较不同模型把 HTML/CSS 里的 <div> 正确居中时,需要输出多少 token。
图里明确写着“越低越好”,指标是 100 组随机 prompt 下的首轮回复 token 中位数。参与对比的有 Claude Opus 5、GPT-5.6 Sol、Gemini 3.1 Pro、Grok 4.5、Claude Fable 5、Kimi K3、GPT-5.6 Terra 和 GPT-5.6 Luna。按这项指标看,GPT-5.6 Luna 最省 token,而 Claude Opus 5 最费。
「模型」频道最新
- GPT-5.6 Sol Ultra 找到严重漏洞,却拒绝展示细节 — haltakov · 2026-07-29
- 转发称 Kimi K3 在基准榜上压过 Anthropic 模型 — JarnoDuursma · 2026-07-29
- 用户实测 Grok 生成能力大幅提升:10 分钟完成创作 — djcows · 2026-07-29
- 用户要求 Anthropic 先修好再弃用 Opus 4.6 — oyacaro · 2026-07-29
- Claude Code 隐藏技巧:手动指定调用旧版 Opus 模型 — voooooogel · 2026-07-29
- Claude Sonnet 3 将在 7 月 30 日退场 — repligate · 2026-07-29