Haiku 5.5 知识工作 Elo 达 1578,但 token 消耗远超同级对手
ArtificialAnlys · x · 2026-10-08
Artificial Analysis 在 Haiku 5.5 评测序列中继续补充:Haiku 5.5(max)在其私有前沿知识工作评测 AA-Briefcase 上达到 1578 Elo,置信区间与 GPT-6 Astra(max)、Claude Fable 5.1(high)相当;同时重申其单任务约 16.2 万 output tokens 的消耗超过 Opus 5.5(max),约为 GPT-6 Luna(max)的 3 倍——智能相近但成本结构不同。
所属事件:Claude Haiku 5.5 评测:智能指数排名第二但 token 消耗惊人(4 条相关)→
「模型」频道最新
- Claude Haiku 5.5 发布:与 GPT-6 Luna 同价,但暗藏 token 膨胀 — Simon Willison · 2026-10-08
- 实测 Haiku 5.5 替代 Opus 跑浏览器测试:漏一项但性价比突出 — kevinkern · 2026-10-08
- 用户实测:Grok 查法律文件找出团队和 AI 检查都漏掉的问题 — iruletheworldmo · 2026-10-08
- Alsop:谁能不阉割新模型,谁就将赢得下一轮 — StewartalsopIII · 2026-10-08
- 求助:64GB 内存+16GB 显存,值不值得从 Qwen 3.6 35B 换 Flash-Next — msalsas · 2026-10-08
- 多模型同题盲测直播:用真实社区与社媒任务比拼写作能力 — thisiskp_ · 2026-10-08