DeepSeek 新模型在 LM Arena 预测排 41 名

Unusual_Guidance2095 · reddit · 2026-08-13

LM Arena 使用其模拟人类偏好的新型自动评估工具进行预测,估计 DeepSeek 即将发布的新模型在榜单上仅位列第 41 名。

这引发了社区讨论:是该模型的对话能力确实表现不佳,还是这套自动评估工具本身存在缺陷与偏差?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →