Grok 4.7 遭实测质疑:多耗 2.5 倍 token 仅高 2 分
ivan_bezdomny · x · 2026-09-22
xAI 官方宣称 Grok 4.7 在同价同速下较 4.6 有显著提升,但有网友对比后提出质疑:
- Grok 4.7 xhigh 在 artificial arena 上多消耗约 2.5 倍 token,仅比前代高 2 分
- 在 cursorbench 上,4.7 low 的得分甚至低于 Grok 4.6 low,且消耗更多 token 与步骤
发帖人据此认为该模型「发布即落伍」,实际性价比不及官方宣传。数据为第三方实测,仅供参考。
所属事件:Grok 4.7 智能指数 46 分进前四,token 消耗翻倍引质疑(9 条相关)→
「模型」频道最新
- Vals AI 评测:Grok 4.7 综合分不升反降,跌至第 24 名 — zacharynado · 2026-09-22
- Grok 4.7 第二例:分析三年财报,识破汇率掩盖的增长真相 — ArtificialAnlys · 2026-09-22
- Grok 4.7 实测案例:能独立跑估值链并质疑交易伙伴的估算 — ArtificialAnlys · 2026-09-22
- Artificial Analysis 实测 Grok 4.7:仅次于 Anthropic,成本约 Opus 5 一半 — ArtificialAnlys · 2026-09-22
- 安全研究者算账:像前沿实验室那样测 ExploitBench 要烧 5930 万美元 API 费 — OwariDa · 2026-09-22
- 小米发布 Qwen 3.5 9B 蒸馏模型,用 MiMo 数据 SFT 并开源 RL 环境 — teortaxesTex · 2026-09-22