Grok 4.6 登顶 GPQA Diamond,以 94.9% 跑分击败 GPT-5.6
elonmusk · x · 2026-08-14
马斯克转发动态宣传 Grok 4.6 的最新跑分成绩。根据 Artificial Analysis 的测试,Grok 4.6 在 GPQA Diamond 评测中以 94.9% 的高分拿下第一名,成功击败了 GPT-5.6、Gemini 3.1 Pro 和 Claude Opus 5 等一众顶级模型。马斯克本人随后发文呼吁大家去试用 Grok 4.6。
所属事件:xAI发布Grok 4.6:多项跑分登顶且性价比远超竞品(88 条相关)→
「模型」频道最新
- 实测对比:Gemini 3.7 Flash 跑赢 Grok 4.6 成编程首选 — brandon_galang · 2026-08-14
- Gemini 3.7 Flash 登顶 Zapier Agent 榜单,性价比远超 Claude 与 GPT — _philschmid · 2026-08-14
- Gemini 3.7 Flash实测:编码与推理能力大幅提升,成本减半 — petrusenko_max · 2026-08-14
- LiquidAI 模型登上 HuggingFace 热门趋势前十 — JosephJacks_ · 2026-08-14
- Gemini 3.7 Flash发布仅三周,其阶梯定价策略引开发者吐槽 — dbreunig · 2026-08-14
- Mistral 被曝转向托管中国模型,并推出内容审查模型 — SumitGup · 2026-08-14