4.3万次调用分析:Claude思考预算被暗中砍半,中位数仅123 tokens
IcyEase · reddit · 2026-09-20
- 一份覆盖 65 天、43000+ 次 Claude Code 调用的分析发现:39% 的 Fable 5 调用拿到零思考 token,中位数仅 123 tokens,而官方基准测试使用 16K-128K。
- 模型每思考 token 的得分在 128K 处仍在上升,说明能力存在但未交付;8 月思考预算较 7 月下降 18-50%,8 月 22 日前后约一周中位数思考量直接归零。
- 作者指控 Anthropic 一边售卖「完整模型访问」,一边悄悄下调推理配置;由于模型输出非确定性,用户往往归咎于自己的提示词而非静默降配。发帖人认为这才是付费用户该关注的实质——为所付价格对应的真实能力,而非每周用量限额。
「公司和人」频道最新
- threepointone 谈高级工程师死亡螺旋:一周干一月活却无人知晓 — threepointone · 2026-09-20
- 被吐槽像Chegg和Stack Overflow一样被AI干翻,Grammarly退订后疯狂邮件轰炸用户 — sahilypatel · 2026-09-20
- Thinking Machines 联创 Schulman:目标驱动胜过点子驱动 — tokenbender · 2026-09-20
- 日经特写 GDM 东京负责人全炳河,Sakana 创始人忆 Google Brain 东京岁月 — hardmaru · 2026-09-20
- Demo 作者也是传播推手:jev 项目自推云服务候补名单 — TheMoonMidas · 2026-09-20
- 复盘 Jev 发布爆红逻辑:ChatGPT 背后创始人的 13 个传播要素 — TheMoonMidas · 2026-09-20