DeepSeek V4 Pro 与 Grok 4.6 实测对比引发争议

开发者实测对比了 DeepSeek v4 Pro 0813 与 Grok 4.6 的表现。结果显示,Grok 4.6 的一次生成成功率略优,但 DeepSeek 以极低成本(仅 Grok 的七分之一)维持了显著的性价比优势。同时,社区对 AI 实验室发布模型时总是挑选对自身有利的基准跑分提出批评,认为实验室挑分基准难以反映模型的真实实力。

2026-08-13 ~ 2026-08-13 · 2 条相关