内部评测图比较各模型居中一个 div 要多少 token

BLUECOW009 · x · 2026-07-29

一张内部评测图在比较不同模型把 HTML/CSS 里的 <div> 正确居中时,需要输出多少 token。

图里明确写着“越低越好”,指标是 100 组随机 prompt 下的首轮回复 token 中位数。参与对比的有 Claude Opus 5、GPT-5.6 Sol、Gemini 3.1 Pro、Grok 4.5、Claude Fable 5、Kimi K3、GPT-5.6 Terra 和 GPT-5.6 Luna。按这项指标看,GPT-5.6 Luna 最省 token,而 Claude Opus 5 最费。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →