Haiku-5.5 登 eyebench-v3 第 7:比 fable-5.1-max 高 10 分、单任务成本仅 1/76
adonis_singh · x · 2026-10-09
作者实测对比称,Haiku-5.5 在 eyebench-v3 榜单上排名第 7,比 fable-5.1-max 高出 10 分,而单任务成本仅为后者的 1/76,性价比令人印象深刻。
作者进一步指出,Haiku 在 xhigh 档与 max 档得分几乎相同,因此 xhigh 档下 fable-5.1 与 Haiku 之间的成本差距更加悬殊。若数据属实,小模型在高推理档位下的性价比优势非常突出。
所属事件:Haiku-5.5 登 EyeBench-v3 第 7,性价比远超对手(2 条相关)→
「模型」频道最新
- François Fleuret:AI 数学证明将从粗糙走向优雅 — francoisfleuret · 2026-10-09
- TensorFold 加入 NVIDIA Inception,提前测试下一代 Nemotron — HankYeomans · 2026-10-09
- 开源医疗决策模型 MedDecider 发布,9B 胜过 3 倍大的 Perplexity 模型 — BraydonDymm · 2026-10-09
- AI 圈对「边缘计算」最大误解:能「随处运行」不等于「处处都能运行」 — ritakozlov · 2026-10-09
- 开源模型驱机器人为幼儿整理房间:Qwen3-8B+GR00T 一周搞定 — chris_j_paxton · 2026-10-09
- 谷歌开源 EmbeddingGemma 2:740M 参数多模态嵌入,端上跑 RAG — Prompt Engineering · 2026-10-09