Anthropic 发布 Claude Haiku 5.5:一年涨 26 分,价格降至前代 10%
ArtificialAnlys · x · 2026-10-08
Anthropic 发布 Claude Haiku 5.5,在 Artificial Analysis 智能指数中得分 43,较上一代 Haiku 一年内提升 26 分,是首款支持 effort 设置与自适应思考的 Haiku 模型,并引入分层定价。
关键要点
- 小模型中的领先表现:max effort 下略优于 GLM-5.3 Flash(42)、Gemini 3.8 Flash(41)、GPT-6 Luna(38),接近 2.8T 参数开源模型 Kimi K3(44),落后 Claude Sonnet 5.5(max,56)13 分。
- token 消耗偏高:max 档每任务约消耗 16.2 万 output tokens,约为 GPT-6 Luna 的 3 倍;从 xhigh 到 max 档,用约 1.8 倍 tokens 换取 2 分提升。
- Agent 知识工作能力强:AA-Briefcase(私密知识工作评测)达 1578 Elo,领先 Kimi K3、GLM-5.3 等。
- 终端使用大幅进步:Terminal-Bench 4.0 得分 33%(上代 Haiku 4.5 为 0%),持平 GLM-5.3 Flash。
- 知识面窄但幻觉低:AA-Omniscience 准确率仅 36%(Gemini 3.8 Flash 55%),但幻觉率 40%,低于对比模型。
- AutomationBench 得分或被低估:35% 的成绩因发布前过度拒答的安全拦截问题偏低,Anthropic 正在修复。
定价与规格:10 万 tokens 以内 $0.10/$0.50 每百万输入/输出 tokens(为前代价格 10%,与 GPT-6 Luna 持平),超过后升至 $0.50/$2.50;上下文窗口扩至 100 万 tokens(前代 20 万);支持文本与图像输入。
所属事件:Anthropic发布Claude Haiku 5.5,成本降约75%(32 条相关)→
「模型」频道最新
- ChatGPT 推出智能 UI:按问题即时生成定制交互界面 — sama · 2026-10-08
- 爆OpenAI向全部ChatGPT用户推送GPT-6与智能交互UI — testingcatalog · 2026-10-08
- OpenAI 向全部用户推送新版 GPT-6,称模型与基建同步升级支撑 12 亿用户 — charliermarsh · 2026-10-08
- OpenRouter 上线决策模型排行:typesafeai 全面领跑 — multiply_matrix · 2026-10-08
- Vik Paruchuri 发声:受启发不等于可以改许可证抄袭模型 — VikParuchuri · 2026-10-08
- Haiku 5.5 比 Sonnet 5.5 便宜 20 倍,开发者用它并行跑子智能体 — RLanceMartin · 2026-10-08