Haiku 5.5 知识工作 Elo 达 1578,但 token 消耗远超同级对手

ArtificialAnlys · x · 2026-10-08

Artificial Analysis 在 Haiku 5.5 评测序列中继续补充:Haiku 5.5(max)在其私有前沿知识工作评测 AA-Briefcase 上达到 1578 Elo,置信区间与 GPT-6 Astra(max)、Claude Fable 5.1(high)相当;同时重申其单任务约 16.2 万 output tokens 的消耗超过 Opus 5.5(max),约为 GPT-6 Luna(max)的 3 倍——智能相近但成本结构不同。

所属事件:Claude Haiku 5.5 评测:智能指数排名第二但 token 消耗惊人(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →