专题 · FULL STORY

Claude Haiku 5.5:从曝光到发布与实测

10 月 8 日,Claude Code 更新中率先曝出 Claude Haiku 5.5 痕迹与对标 GPT-6 Luna 的定价传闻;同日 Anthropic 正式发布该模型,称其为最便宜最快的小模型,成本较上代降约 75%;随后 Artificial Analysis 实测显示其智能指数排名第二,但 token 消耗惊人。

2026-10-08 ~ 2026-10-08 · 3 集 · 41 条

第 1 集 · Claude Haiku 5.5 曝光:定价对标 GPT-6 Luna(2026-10-08,3 条)

爆料称在 Claude Code 最新更新中已发现 Claude Haiku 5.5 的踪迹,预计随时正式发布。定价传闻:10 万 token 上下文以内输入每百万 0.1 美元,与 GPT-6 Luna 对齐,但长上下文场景下价格可达 Luna 的 5 倍。另有一条未经证实的对比称,Haiku 5.5 在各基准上全面胜过 GPT-6 Luna,Terminal-Bench 4.0 得分超过 Luna 两倍。

第 2 集 · Anthropic 发布 Claude Haiku 5.5,成本较上代降约 75%(2026-10-08,34 条)

10 月 8 日,Anthropic 官方发布 Claude Haiku 5.5,称其为迄今「最便宜、最快、能力最强」的小模型,平均运行成本比上代 Haiku 4.5 低约 75%,同时 Sonnet 缓存价格同步下调。消息由官方账号 @claudeai、@AnthropicAI 等直接发布,属已确认的官方发布,模型已在 Claude Platform 与 Claude Code 上线并逐步推送。

已确认

  • 平均运行成本比 Claude Haiku 4.5 低约 75%;10 万 token 以下任务便宜达 10 倍,官方称这类任务约占前代 Haiku 请求量的 90%。
  • 分段定价:100K tokens 以下提示,输入 $0.10、输出 $0.50 每百万 tokens,缓存读取 $0.01;超过 100K tokens 则输入 $0.50、输出 $2.50。据 Artificial Analysis 的数据,其价格降至前代约 10%。
  • 官方称在编码、computer use 和知识工作三大能力上较 Haiku 4.5 显著提升。据 markk 汇总的榜单数据,OSWorld 2.1 计算机操作成绩从 Haiku 4.5 的 15.7% 升至 72.4%,并在双方均有报告成绩的榜单上全部超过 GPT-6 Luna。Artificial Analysis 智能指数方面,Haiku 5.5 得分 43,一年内较上一代 Haiku 提升 26 分。
  • Haiku 5.5 是首个带可调 effort 参数的 Haiku 模型,也是首款支持 effort 设置与自适应思考的 Haiku,用户可按任务在成本与智能水平间权衡。
  • 官方称模型在几乎所有对齐评测中较 Haiku 4.5 有重大改进,失当行为频率显著降低。
  • 定位高流量、成本敏感任务,可稳定处理摘要、分类等重复性工作,可作为编码子代理与 Opus 5.5、Sonnet 5.5 配合,速度足以支撑实时客服与浏览器操作。
  • Sonnet 缓存价格同步下调。Anthropic 的 Alex Albert 补充了 Haiku 4.5 于 2025 年发布的历史背景;马斯克罕见公开称赞「又一个好模型」。

为什么重要

  • 75% 的成本降幅大幅拉低小模型使用门槛,对客服、批处理、agent 任务等高流量、成本敏感型应用的选型影响直接。
  • 编码与 computer use 能力大幅提升(OSWorld 2.1 提升 56.7 个百分点)意味着小模型可承接更多原本需要大模型的任务,并直接与 GPT-6 Luna 等竞品竞争,加剧小模型赛道的性价比竞争。
  • 可调 effort 参数与分段计费为开发者提供了更细粒度的成本控制手段:Anthropic 开发者关系负责人 Lydia Hallie 分享技巧,API 计费用户可将 autocompact 窗口设为 100K 使上下文始终留在便宜计费档,每百万 token 可省约 5 倍;开发者 bcherny 评价 Haiku 5.5 是一款「合格的 Haiku」级模型。

还有 14 条相关讨论 →

第 3 集 · Claude Haiku 5.5 评测:智能指数排名第二但 token 消耗惊人(2026-10-08,4 条)

Artificial Analysis 上线 Claude Haiku 5.5 评测页面,该系列共 5 个变体,最强版本智能指数 43,在 179 个同类模型中排名第 2。Haiku 5.5(max)在私有前沿知识工作评测 AA-Briefcase 上达到 1578 Elo,逼近 GPT-6 Astra。但其单任务消耗约 16.2 万 output tokens,约为 GPT-6 Luna 的三倍,token 消耗远超同级对手。