Qwen3.8Max深度评测:编程与Agent达一流,多模态补齐短板
葬AI · wechat · 2026-08-05
文章对 Qwen3.8Max 进行了全面评测,认为其编程与 Agent 能力达到一流水平,略超 K3,但弱于 GPT5.6 和 Opus5。在真实浏览器任务测试中,该模型表现优异且极具性价比,但在一次性生成网页等前端产品化能力上仍落后于 K3。
多模态方面,Qwen3.8Max 正式版较预览版有明显进步,能较好完成图像生成 3D 模型和动画,但整体效果仍不及 GPT5.6。作者指出,国产大模型正陷入极速迭代的同质化竞争,单个模型的领先优势难以超过一个月。
随着模型能力趋同且价格战加剧,大模型性价比将持续飙升,这将极大推动 AI 应用层(尤其是办公 Agent 和垂直工具)的爆发。
所属事件:Qwen 3.8 Max 实测:编程与多模态能力比肩前沿闭源模型(11 条相关)→
「模型」频道最新
- Kimi K3 上线 Together AI,可免费免设 API 体验 — togethercompute · 2026-08-05
- 单条提示词构建应用:Kimi K3 联手 Claude Code 实测 — markjeffrey · 2026-08-05
- Intern-S2-Mobius 模型发布:重构架构以提升吞吐量 — Miserable-Dare5090 · 2026-08-05
- 阿里 Qwen3.8-Max 登顶图生网页榜亚军 — rohanpaul_ai · 2026-08-05
- Grok 被指护栏收紧变保守,用户抱怨其失去早期特色 — Promptmethus · 2026-08-05
- KOL称思维链可见性使其更偏好 DeepSeek — yacineMTB · 2026-08-05