Haiku 5.5 在 AA-Briefcase 达 1578 Elo,逼近 GPT-6 Astra
ArtificialAnlys · x · 2026-10-08
Artificial Analysis 发布了 Claude Haiku 5.5 在智能指数各单项评测中跨 effort 档位的完整分解数据。其中 Haiku 5.5(max)在其私有的前沿知识工作评测 AA-Briefcase 上达到 1578 Elo,置信区间与 GPT-6 Astra(max)和 Claude Fable 5.1(high)重叠,显示这款小模型在真实知识工作场景中已接近旗舰模型水平。
所属事件:Haiku 5.5 评测出炉:知识工作逼近 GPT-6 但 token 消耗偏高(3 条相关)→
「模型」频道最新
- ChatGPT 推出智能 UI:按问题即时生成定制交互界面 — sama · 2026-10-08
- 爆OpenAI向全部ChatGPT用户推送GPT-6与智能交互UI — testingcatalog · 2026-10-08
- OpenAI 向全部用户推送新版 GPT-6,称模型与基建同步升级支撑 12 亿用户 — charliermarsh · 2026-10-08
- OpenRouter 上线决策模型排行:typesafeai 全面领跑 — multiply_matrix · 2026-10-08
- Vik Paruchuri 发声:受启发不等于可以改许可证抄袭模型 — VikParuchuri · 2026-10-08
- Haiku 5.5 比 Sonnet 5.5 便宜 20 倍,开发者用它并行跑子智能体 — RLanceMartin · 2026-10-08