Grok 4.7 跑分升至 38%,输出 token 多耗 125%
dl_weekly · x · 2026-09-27
- 据 dlweekly 评测周报,xAI 的 Grok 4.7 在 Terminal-Bench 4.0 上的成绩从 Grok 4.6 的 20.3% 提升至 38.0%。
- 代价是输出 token 比上一代多消耗 125%,每个 Intelligence Index 任务的成本升至 3.74 美元。
- 结论:能力提升显著,但推理成本同步大涨,性价比值得权衡。
「模型」频道最新
- rasbt 与 marlene_zw 对谈:Claude 水印与推理模型技术拆解 — marlene_zw · 2026-09-27
- Anthropic Opus 5.5 惊人高效:能力顶级,费率还出奇便宜 — kimmonismus · 2026-09-27
- 本地 AI 社区喊话 Qwen:回归 35B 级 MoE,救活 4-16GB 显存用户 — julianharris · 2026-09-27
- TypeSafe 推出决策专用模型 Jev:返回类型化决策而非生成文本 — Rahulstark2 · 2026-09-27
- Codex 团队频繁暗示「速度」,传 GPT-6 Astra 或登 Cerebras — haider1 · 2026-09-27
- 人类一眼看懂的图,ChatGPT/Gemini/Grok 全都认不出 — JeremyNguyenPhD · 2026-09-27