DeepSeek V4 Pro 与 Grok 4.6 实测对比引发争议
开发者实测对比了 DeepSeek v4 Pro 0813 与 Grok 4.6 的表现。结果显示,Grok 4.6 的一次生成成功率略优,但 DeepSeek 以极低成本(仅 Grok 的七分之一)维持了显著的性价比优势。同时,社区对 AI 实验室发布模型时总是挑选对自身有利的基准跑分提出批评,认为实验室挑分基准难以反映模型的真实实力。
2026-08-13 ~ 2026-08-13 · 2 条相关
- DeepSeek v4 Pro 评测引争议:实验室挑分基准难辨真实力 — kristoph · 2026-08-13
- 实机对比:Grok 4.6 成功率略胜 DeepSeek,但价格仍处下风 — vista8 · 2026-08-13