阿里开源 Qwen3.8-Flash:125B MoE 成本降九成

阿里发布并开源 Qwen3.8-Flash 模型,采用新一代 MoE 架构,总参数 125B 但每个 Token 仅激活约 6B,训练成本较此前大幅下降约九成。该模型原生支持 262k 上下文并可扩展至 1M token,消费级 4090 显卡也能运行。官方与第三方评测称其在编程、办公等核心任务上超越 Claude Opus 4.6,Two Minute Papers 等媒体称其性能可匹敌大厂数十亿美元级模型且完全免费。

2026-08-28 ~ 2026-08-28 · 3 条相关

事件全程(共 6 集)→