疑似阿里 Qwen 3.8 Max 泄露,跑分与实测表现强劲
近日,疑似阿里巴巴的 Qwen 3.8 Max 预览版模型遭到泄露并引发社区热议。据称该模型参数量达 2.4T,官方宣称是“除 Fable 5 外最强”的模型。目前,该模型在多项基准测试与实际开发测试中均展现出极为强劲的性能表现。
跑分与能力评测
在基准测试方面,泄露的 KingBench 3 排行榜显示 Qwen 3.8 Max 取得 81.25 分,紧咬榜首的 Fable 5(82.5分),并超越多款 Claude 模型。@bdsqlsz 指出,在被称为“candy test”的测试中,其数学能力已超越 GPT 5.5 high 与 Kimi K3,编程能力同样表现突出。在实际应用层面,@赛博禅心 通过 Claude Code 接入该模型进行了包含多重支付逻辑的实际开发测试,证实其编程能力强劲,且实测响应速度非常快。
各方反应与影响
Reddit 等平台上已有大量用户求证该模型的真实性。面对强劲的跑分数据,@orange 表示,如果 Qwen 3.8 真能超过 GPT-5.6,中美模型之间的技术差距可能会因此缩短至约 3 个月,但他计划等实际试用后再做定论。此外,@Scobleizer 转发指出,开源前沿模型越来越大,但基准分数并不等于可承受的推理成本,这也是该模型未来落地需要面对的现实挑战。
2026-07-19 ~ 2026-07-20 · 6 条相关
- 第 1 集:阿里预告2.4T开源模型Qwen3.8(2026-07-19,22 条)
- 第 2 集:疑似阿里 Qwen 3.8 Max 泄露,跑分与实测表现强劲(2026-07-19,6 条)
- 第 3 集:Qwen3.8-Max 预览版扩展至多端(2026-07-19,2 条)
- 第 4 集:阿里 Qwen3.8-Max 预览版实测:编程亮眼但思考耗时(2026-07-19,13 条)
- 第 5 集:阿里 Qwen3.8-Max-Preview 持续按天迭代,前端能力提升(2026-07-20,5 条)
- 第 6 集:阿里预告 Qwen3.8 开放权重及多项 AI 新更新(2026-07-23,2 条)
- 第 7 集:阿里发布Qwen3.8-Max,下周开源权重(2026-08-03,44 条)
- 第 8 集:Qwen3.8-Max多榜跻身第一梯队,开源模型紧追闭源(2026-08-03,7 条)
- 第 9 集:传阿里 Qwen3.8-Max 跑分超 Fable 5 并将开源(2026-08-03,2 条)
- 第 10 集:通义千问Qwen3.8-Max初测性能达DeepSeek水平(2026-08-03,2 条)
- 第 11 集:阿里发布Qwen3.8-Max,开源模型逼近闭源前沿(2026-08-03,13 条)
- 第 12 集:Kimi K3与Qwen3.8 Max评测逼近顶尖闭源模型(2026-08-05,2 条)
- 第 13 集:传阿里将发 Qwen3.8-Max:2.4T 参数仅激活 95B(2026-08-05,5 条)
- 第 14 集:阿里发布Qwen3.8-Max登顶智能体榜,下周开源(2026-08-06,11 条)
- 第 15 集:实测阿里 Qwen3.8-Max:长程 Agent 能力表现亮眼(2026-08-06,3 条)
- 第 16 集:传阿里 Qwen 3.8 模型下周发布,涵盖 2.4T 与 27B 版本(2026-08-07,2 条)
- 第 17 集:网传阿里发布 Qwen3.8-Max(2026-08-09,2 条)
一手来源
- Qwen 3.8 Max 预览版基准泄露 — bdsqlsz ·
- 疑似 Qwen3.8 预览版曝光:2.4T参数实测速度快,编程能力强 — 赛博禅心 ·
- Qwen 3.8 基准测试流出 — mark_k ·
- 传闻:Qwen 3.8 要来了 — OutlandishnessNo5636 · 2026-07-19
- 【源头】Qwen 3.8 Max 预览版基准泄露 — bdsqlsz · 2026-07-19
- 【源头】疑似 Qwen3.8 预览版曝光:2.4T参数实测速度快,编程能力强 — 赛博禅心 · 2026-07-19
- 【源头】Qwen 3.8 基准测试流出 — mark_k · 2026-07-20
- Qwen 3.8 被指或超 GPT-5.6 — oran_ge · 2026-07-20
- Qwen3.8 Max 传出 2.4T 参数 — Scobleizer · 2026-07-20