Grok 4.7 登顶 VulcanBench 编码榜,93.15 分通过全部 23 项任务
elonmusk · x · 2026-10-07
马斯克转发了 Grok 4.7 在编码基准 VulcanBench Frontier v4 上拿下第一的消息:前三名全部由 Grok 4.7 包揽,其中夺冠成绩 93.15 分,并通过了全部 23 个高难度编码任务。
所属事件:Grok 4.7 包揽 VulcanBench 编码榜前三(2 条相关)→
「模型」频道最新
- Reddit 用户吐槽 ChatGPT 频繁误判违规:"对不起,戴夫"式拒绝越来越多 — Crixusgannicus · 2026-10-07
- Runware API 上线两款内容审核模型,政策用自然语言描述即可 — aziz4ai · 2026-10-07
- Ethan Mollick 提醒 AI 实验室:先确保自家模型会用自家产品 — emollick · 2026-10-07
- OpenAI 推出 Decisions API 公测:比 GPT-6 Luna 快 10 倍替应用做决策 — OpenAIDevs · 2026-10-07
- Cloudflare 开源视觉决策模型 clef,速度惊艳引热议 — michellechen · 2026-10-07
- 团队实测 OpenAI Decisions API:网页质量过滤 AUPRC 达 88.8% — OpenAIDevs · 2026-10-07