跑分对比引热议:更小的 Claude Haiku 5.5 分数反超 GLM 5.3 Flash
rickasaurus · x · 2026-10-08
scaling01 发帖对比基准测试成绩:高亮出真正的最高分,并指出 Claude Haiku 5.5 的模型规模大概率远小于 GLM 5.3 Flash,暗示其参数效率更出色。该对比由 TheZachMueller 的原始榜单截图引出(其本人注明数据由 Codex 查找,可能有偏差)。
「模型」频道最新
- Sebastian Raschka 长文:从词袋到 Jev,文本分类模型演进全解析 — AxSaucedo · 2026-10-08
- 开发者自测「夜火车基准」:GPT-6 Luna 比 Haiku 5.5 快 5 倍还便宜三分之二 — RexDouglass · 2026-10-08
- 开源权重会永远免费吗:领先时闭源收费才是理性选择 — Atlan_ · 2026-10-08
- Qwen Flash 极低比特量化实测:Q2_0 更稳,IQ2_XS 知识保留更好但易循环 — dampflokfreund · 2026-10-08
- 逆向工程社区爆发:闭源模型已能玩转反编译,开源模型行不行? — EmPips · 2026-10-08
- 小型实测:DeepSeek V4.1 Flash 击败 Haiku 5.5,研究子代理与标题双胜 — dergachoff · 2026-10-08