阿里 Qwen3.8-Max 预览版实测:编程亮眼但思考耗时
阿里巴巴发布了新一代旗舰基座模型 Qwen3.8-Max-Preview,据称参数量达到 2.4 万亿。该模型已在官网和编程应用 Qoder 中开放直接体验,因其宣称的强大性能引发了社区的密集上手实测,但反馈呈现出明显的两极分化。
亮点表现:编程与工作流
在编程和任务执行方面,该模型获得了不少好评。@johnseach 称其一次性写出了 1500 行天体物理代码且零错误;@APPSO 实测发现其生成网页速度极快,能快速产出 Three.js 3D 跑车等复杂页面。在 Qoder 的工作流测试中,@HeyNayeem 指出模型能持续推进任务直至结束,几乎不需要人工介入。此外,@青稞AI 将其接入项目开发共享钱包等复杂功能,@Askmasr_mod 也肯定了其在创意设计上的突出写作能力。
争议与存疑:思考耗时与预期落差
尽管能力亮眼,但预览版的缺陷和口碑分化也十分明显。@curiousily_ 实测发现模型有时会陷入思维循环,前端能力不及宣传;@Askmasr_mod 指出其最大问题是“思考时间”过长,连简单提示词也可能耗时良久。在整体评价上,@davidtsong 观察到 X 上的反馈明显分化,有观点认为它未达到“Fable level”的预期。@teortaxesTex 坦言 Qwen 预览版一贯较为粗糙,更多是科研参考价值,预计其真实水平大致在 GLM 5.2 或更好的区间。
测试建议
针对模型表现的不稳定,@terryyuezhuo(转发)建议评估时应看 API 而非网页端,因为网页聊天仅是免费试用入口,输出质量一直不够稳定,API 才能反映真实水平。@vista8 也提醒,网页端目前主要适合测文本和简单代码,不过身边朋友反馈模型确实在变强。
2026-07-19 ~ 2026-07-21 · 13 条相关
- 第 1 集:传闻称Gemini 3.5能力接近GPT-5.5水平(2026-07-05,3 条)
- 第 2 集:7月前沿AI模型发布时间表传闻汇总(2026-07-06,5 条)
- 第 3 集:多款重磅大模型版本近期密集发布(2026-07-08,3 条)
- 第 4 集:Gemini 3.5 Pro 多次传出延期与性能争议(2026-07-10,6 条)
- 第 5 集:AI基建牛市逻辑:开源模型或压缩前沿实验室利润(2026-07-13,3 条)
- 第 6 集:AI效率提升反将放大需求(2026-07-13,2 条)
- 第 7 集:传 Gemini 3.5 Pro 近期发布(2026-07-14,3 条)
- 第 8 集:Kimi K3 预热升温,KIVINE 现身 Arena(2026-07-14,43 条)
- 第 9 集:Gemini 3.5 Pro 再延期传闻升温(2026-07-15,7 条)
- 第 10 集:前沿 AI 模型发布潮即将爆发(2026-07-15,2 条)
- 第 11 集:AI开源激辩:封闭能否换来安全(2026-07-15,10 条)
- 第 12 集:多家新模型发布传闻齐出,厂商均未官宣(2026-07-15,7 条)
- 第 13 集:Kimi K3 上线冲榜,开权重逼近前沿(2026-07-15,184 条)
- 第 14 集:Kimi K3 登顶前端代码榜引热议(2026-07-16,53 条)
- 第 15 集:大模型前沿优势窗口仅剩数月(2026-07-16,2 条)
- 第 16 集:Kimi K3 引爆中国前沿模型再评估(2026-07-16,94 条)
- 第 17 集:Kimi K3 性能比肩顶级模型引发 AI 圈热议(2026-07-16,3 条)
- 第 18 集:Kimi K3 实战编码能力引发争论(2026-07-16,6 条)
- 第 19 集:Kimi K3 开权重引爆开放模型争论(2026-07-17,15 条)
- 第 20 集:Kimi K3编码实测接近前沿但体验欠佳(2026-07-17,3 条)
- Qwen3.8-Max-Preview 编程表现被夸 — johnseach · 2026-07-19
- 【源头】Qwen3.8 在 Qoder 的工作流表现 — HeyNayeem · 2026-07-19
- Qoder 里它能自己做完任务 — HeyNayeem · 2026-07-19
- Qwen3.8 preview 上手实测 — 青稞AI · 2026-07-20
- 【源头】实测 Qwen 3.8:会陷入思维循环 — curiousily_ · 2026-07-20
- Qwen 3.8 Preview 预期偏保守 — teortaxesTex · 2026-07-20
- Qwen 3.8 Preview 能否接近前沿 — teortaxesTex · 2026-07-20
- Qwen 3.8 Max 实测横评 — WorldofAI · 2026-07-20
- 【源头】Qwen3.8-Max预览版实测与国产大模型现状 — APPSO · 2026-07-20
- 评估Qwen 3.8 Max要看API — terryyuezhuo · 2026-07-20
- Qwen 3.8 口碑分化 — davidtsong · 2026-07-21
- Qwen 3.8 Max 写作很强,但思考模式太耗时 — Askmasr_mod · 2026-07-21
- Qwen3.8-max-Preview 可直接网页实测,用户称代码能力在变强 — vista8 · 2026-07-21