DeepSeek v4 Pro 评测:多数任务接近 Flash 版,架构扩展性引疑

teortaxesTex · x · 2026-08-17

社区评测显示,DeepSeek v4 Pro (0813) 在 WeirdML 基准上得分 66.2%,虽优于初始版并小幅领先 v4 Flash (63.0%),但在多数评测中与 Flash 表现差异极小。有观点质疑这表明 v4 架构可能难以有效扩展至 Pro 级别。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →