Box 实测 Opus 5.5:token 省 63%,速度提升 30% 且更便宜
bcherny · x · 2026-09-24
Box 正在企业知识工作场景实测 Claude Opus 5.5,称其达到前沿能力水平,相对 Opus 5 表现显著提升:token 消耗减少 63%、输出更简洁(冗余减少 42%)、速度快 30%,且模型本身运行成本再降 40%(官方称比 Opus 5 便宜 40%)。
部分行业测试结果:
- 金融服务尽调任务(+39% 任务准确率):在一年交易记录中找出定价工具所有计算错误,Opus 5.5 每次全部命中,用词仅 Opus 5 一半,token 少用 82%。
- 适用于 agentic 电脑操作、编码、分析与数据类企业工作负载。
同条推文引用了 Anthropic 官方发布:Claude Opus 5.5 是 Claude 5.5 家族首款模型,多数任务表现与 Claude Fable 5.1 相当。
「公司和人」频道最新
- Shopify CEO Tobi 播客:AI 已让操作系统完全可塑 — andreisavu · 2026-09-24
- QClaw 停运:腾讯 WorkBuddy 内部赛马再胜一局 — sven_ai · 2026-09-24
- OpenAI 工程负责人预热下周 DevDay:将发布改变工作方式的重磅内容 — TheMoonMidas · 2026-09-24
- Pokee AI 携手 Google:一句话从想法生成完整 Shopify 店铺 — Kyrannio · 2026-09-24
- 圈内复盘 Google 为何错失 AI:算力不足偏好小模型,安全文化劝退先驱 — gandamu_ml · 2026-09-24
- 谷歌缺个人 Agent 产品基因,碎片化组织恐难敌 Meta Muse — signulll · 2026-09-24