实测打脸:Grok 4.7 每任务 token 反而少 46%
ns123abc · x · 2026-09-22
有博主用两句引导性 prompt 在前端 playground 里「跑出」Grok 4.7 token 效率差 30-80%、贵一倍的结论,但真实工程遥测数据相反:
- Cursor:生产环境中 Grok 4.7 中位数请求 token 仅多约 5%,且用户对它的提问分布也发生了变化
- Mercor:Grok 4.7 每任务 token 比 Grok 4.6 少 46%(23.8k vs 44.1k)
作者强调这是「用 vibe prompt 制造 ragebait」vs 实际遥测的典型案例,提醒别信前端 playground 的花式测法。
「模型」频道最新
- Limite 发布 1B 数学小模型:参数仅 10 亿,数据不到 300B token — tensorqt · 2026-09-22
- 顶级开源模型后训练成本仅 350 万美元,远低于前沿实验室投入 — Kyrannio · 2026-09-22
- 37 项基准 13 万次决策:单卡 RTX 6000 Pro 实测本地模型排行 — multimodalart · 2026-09-22
- Decision Index 0.1 发布:向每个模型提问 13 万次横评 30+ 决策模型 — multimodalart · 2026-09-22
- 小米发布 MiMo-V2.6-Distill-Qwen-9B:9B 智能体专用蒸馏模型 — anovers · 2026-09-22
- Qwen 发布 3.8 实时翻译模型,直击 Wispr、Fireflies 腹地 — Necessary-Garlic-704 · 2026-09-22