DeepSeek 掉队了?v4 Pro 基准成绩不敌 Qwen、GLM 开源模型
power97992 · reddit · 2026-09-03
Reddit 用户发帖质疑 DeepSeek 现状:从 v3/v3.2 时期的第一梯队到如今,DS v4 Pro 0813 在基准测试中落后于 GLM 5.3 Flash、Qwen 3.8 Next 等前沿开源模型,而 v4 Flash 表现还不错。发帖人猜测 v4 Pro 可能未训练到全部潜力,KV cache 压缩与混合注意力等效率优化或拖累了性能;还提到 DeepSeek 有人才流向小米等公司的传闻,并追问 DeepSeek 能否在一两个月内追平 Qwen、Kimi 和 GLM。
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03