Opus 5.5 每任务耗 token 最多,Nat Lambert 称登顶榜单反成红旗
natolambert · x · 2026-09-23
引用推文指出,新 Opus 在 Artificial Analysis 的 Intelligence Index 上是所有被测模型中每个任务消耗 token 最多的「token 吞噬怪兽」,这解释了 Anthropic 为何降价。知名 RL 研究者 Nathan Lambert 评论称,模型登顶这类榜单通常是红旗信号,他乐意被证明看走眼。核心观点:高分可能靠堆 token 换来,而非真实效率提升。
所属事件:Opus 5.5 登顶 AA 智能指数,实测更快更便宜(23 条相关)→
「模型」频道最新
- 用户质疑 OpenAI Codex 新定价:两周内额度两日烧光 — cocktailpeanut · 2026-09-23
- 两项研究:AI 聊天机器人理财建议错误率高达 57%-85% — PtrPomorski · 2026-09-23
- 博主实测 GPT-6 Sol:任务从 1 小时缩到 20 分钟,token 省一半 — flavioAd · 2026-09-23
- Perplexity 官宣 GPT-6 Sol 接入,成 Computer 默认 Light 选项 — perplexity_ai · 2026-09-23
- Claude Opus 5.5 medium 更贵但几乎全面胜过 Astra — ChrisGPT · 2026-09-23
- Perplexity 全量上线 GPT-6 Sol:评测胜 Opus 5,价格仅五分之一 — AravSrinivas · 2026-09-23