DeepSeek 新模型在 LM Arena 预测排 41 名
Unusual_Guidance2095 · reddit · 2026-08-13
LM Arena 使用其模拟人类偏好的新型自动评估工具进行预测,估计 DeepSeek 即将发布的新模型在榜单上仅位列第 41 名。
这引发了社区讨论:是该模型的对话能力确实表现不佳,还是这套自动评估工具本身存在缺陷与偏差?
「模型」频道最新
- DeepSeek API 模型指纹疑变更,或已上线新版本 — teortaxesTex · 2026-08-13
- 用户反馈 Google 模型近期严重降智 — EthanBeMe · 2026-08-13
- 通义千问 Qwen3.8-27B 模型已上线 ModelScope — Ok-Shower7286 · 2026-08-13
- 网传 Grok 4.6 发布:Agent 能力领先,编程反超 GPT-5.6 — rohanpaul_ai · 2026-08-13
- 传 Claude 将为所有输出嵌入隐形水印 — AccBalanced · 2026-08-13
- 用户困惑:AI Plus 订阅为何能用 Gemini Pro? — SternButFaiir · 2026-08-13