阿里 Qwen3.8-Max 预览版实测:编程亮眼但思考耗时
阿里巴巴发布了新一代旗舰基座模型 Qwen3.8-Max-Preview,据称参数量达到 2.4 万亿。该模型已在官网和编程应用 Qoder 中开放直接体验,因其宣称的强大性能引发了社区的密集上手实测,但反馈呈现出明显的两极分化。
亮点表现:编程与工作流
在编程和任务执行方面,该模型获得了不少好评。@johnseach 称其一次性写出了 1500 行天体物理代码且零错误;@APPSO 实测发现其生成网页速度极快,能快速产出 Three.js 3D 跑车等复杂页面。在 Qoder 的工作流测试中,@HeyNayeem 指出模型能持续推进任务直至结束,几乎不需要人工介入。此外,@青稞AI 将其接入项目开发共享钱包等复杂功能,@Askmasrmod 也肯定了其在创意设计上的突出写作能力。
争议与存疑:思考耗时与预期落差
尽管能力亮眼,但预览版的缺陷和口碑分化也十分明显。@curiousily 实测发现模型有时会陷入思维循环,前端能力不及宣传;@Askmasrmod 指出其最大问题是“思考时间”过长,连简单提示词也可能耗时良久。在整体评价上,@davidtsong 观察到 X 上的反馈明显分化,有观点认为它未达到“Fable level”的预期。@teortaxesTex 坦言 Qwen 预览版一贯较为粗糙,更多是科研参考价值,预计其真实水平大致在 GLM 5.2 或更好的区间。
测试建议
针对模型表现的不稳定,@terryyuezhuo(转发)建议评估时应看 API 而非网页端,因为网页聊天仅是免费试用入口,输出质量一直不够稳定,API 才能反映真实水平。@vista8 也提醒,网页端目前主要适合测文本和简单代码,不过身边朋友反馈模型确实在变强。
2026-07-19 ~ 2026-07-21 · 13 条相关
- 第 1 集:阿里预告2.4T开源模型Qwen3.8(2026-07-19,22 条)
- 第 2 集:疑似阿里 Qwen 3.8 Max 泄露,跑分与实测表现强劲(2026-07-19,6 条)
- 第 3 集:Qwen3.8-Max 预览版扩展至多端(2026-07-19,2 条)
- 第 4 集:阿里 Qwen3.8-Max 预览版实测:编程亮眼但思考耗时(2026-07-19,13 条)
- 第 5 集:阿里 Qwen3.8-Max-Preview 持续按天迭代,前端能力提升(2026-07-20,5 条)
- 第 6 集:阿里预告 Qwen3.8 开放权重及多项 AI 新更新(2026-07-23,2 条)
- 第 7 集:阿里发布Qwen3.8-Max,下周开源权重(2026-08-03,44 条)
- 第 8 集:Qwen3.8-Max多榜跻身第一梯队,开源模型紧追闭源(2026-08-03,7 条)
- 第 9 集:传阿里 Qwen3.8-Max 跑分超 Fable 5 并将开源(2026-08-03,2 条)
- 第 10 集:通义千问Qwen3.8-Max初测性能达DeepSeek水平(2026-08-03,2 条)
- 第 11 集:阿里发布Qwen3.8-Max,开源模型逼近闭源前沿(2026-08-03,13 条)
- 第 12 集:Kimi K3与Qwen3.8 Max评测逼近顶尖闭源模型(2026-08-05,2 条)
- 第 13 集:传阿里将发 Qwen3.8-Max:2.4T 参数仅激活 95B(2026-08-05,5 条)
- 第 14 集:阿里发布Qwen3.8-Max登顶智能体榜,下周开源(2026-08-06,11 条)
- 第 15 集:实测阿里 Qwen3.8-Max:长程 Agent 能力表现亮眼(2026-08-06,3 条)
- 第 16 集:传阿里 Qwen 3.8 模型下周发布,涵盖 2.4T 与 27B 版本(2026-08-07,2 条)
- 第 17 集:网传阿里发布 Qwen3.8-Max(2026-08-09,2 条)
一手来源
- Qwen3.8-Max预览版实测与国产大模型现状 — APPSO ·
- 实测 Qwen 3.8:会陷入思维循环 — curiousily_ ·
- Qwen3.8 在 Qoder 的工作流表现 — HeyNayeem ·
- Qwen3.8-Max-Preview 编程表现被夸 — johnseach · 2026-07-19
- 【源头】Qwen3.8 在 Qoder 的工作流表现 — HeyNayeem · 2026-07-19
- Qoder 里它能自己做完任务 — HeyNayeem · 2026-07-19
- Qwen3.8 preview 上手实测 — 青稞AI · 2026-07-20
- 【源头】实测 Qwen 3.8:会陷入思维循环 — curiousily_ · 2026-07-20
- Qwen 3.8 Preview 预期偏保守 — teortaxesTex · 2026-07-20
- Qwen 3.8 Preview 能否接近前沿 — teortaxesTex · 2026-07-20
- Qwen 3.8 Max 实测横评 — WorldofAI · 2026-07-20
- 【源头】Qwen3.8-Max预览版实测与国产大模型现状 — APPSO · 2026-07-20
- 评估Qwen 3.8 Max要看API — terryyuezhuo · 2026-07-20
- Qwen 3.8 口碑分化 — davidtsong · 2026-07-21
- Qwen 3.8 Max 写作很强,但思考模式太耗时 — Askmasr_mod · 2026-07-21
- Qwen3.8-max-Preview 可直接网页实测,用户称代码能力在变强 — vista8 · 2026-07-21