Grok 4.7 发布:AA 评测仅次 Opus 5,成本约一半
NicoVerderosa · x · 2026-09-22
Elon Musk 宣布 Grok 4.7 发布。第三方 Artificial Analysis 评测显示,在 AA-Briefcase 场景中 Grok 4.7 仅次于 Anthropic 模型,成本约为 Opus 5 每任务成本的一半。
- 在公开的 AA-Briefcase-Lite 尽调场景(构建市场模型与标的分析 deck)中,分析质量 Elo 从 1698 升至 1994,演示 Elo 略降(1531→1499)。
- 成本方面:生成示例 deck 的 API 费用约 $8(xhigh),而 Grok 4.6 约为 $4.40,成本翻倍换取分析能力提升。
所属事件:Grok 4.7 评测:能力进前四但 token 消耗翻倍引争议(24 条相关)→
「模型」频道最新
- 曝 DeepSeek 押注华为芯片训练新模型,梁文锋称「必须成」 — kimmonismus · 2026-09-22
- 小米 MiMo-V2.6-Pro 登顶开源模型,Anthropic 指其蒸馏 Claude 数据 — The Decoder · 2026-09-22
- 腾讯开放微信接口,上百 G 聊天数据处理终于可行 — Xianbao_QIAN · 2026-09-22
- 小米 MiMo-V2.6-Pro 实测修 105 个真实 bug:性价比突出 — PawelHuryn · 2026-09-22
- ChatGPT Pro 用户控诉 GPT-5.6 以「防滥用」之名暗中降质 — princeMacX · 2026-09-22
- 选 Claude 不再只是技术题:Haiku/Sonnet/Opus 该怎么选 — goyalshaliniuk · 2026-09-22