阿里Qwen3.8-Flash-Next发布:每Token仅激活6B参数,价格腰斩
智东西 · wechat · 2026-08-27
阿里千问团队开源基于下一代 Qwen4 架构的 Qwen3.8-Flash-Next 模型。该模型总参数 125B,但通过 MoE 架构每 token 仅激活 6B 参数,训练成本降至前代 1/9。技术上引入 Qwen Sparse Attention (QSA)、Gated Residual (GR) 和 N-gram Embedding 等创新,支持原生 26.2万上下文并可扩展至 100万。在多项基准测试中超过 DeepSeek-V4-Flash 和 Claude-Opus-4.6。API 价格降至每百万 tokens 输入 1 元、输出 3 元,较竞品低 33%。模型权重已在 Hugging Face 和 ModelScope 发布。
所属事件:阿里发布 Qwen3.8-Flash 多模态 MoE 模型,性价比引热议(26 条相关)→
「模型」频道最新
- Gemini 异常泄露内部思维:回复出现 "sff" — Regular_Preference64 · 2026-08-28
- GLM-5.2 引入监控机制,有效对抗 RL 奖励黑客攻击 — burny_tech · 2026-08-28
- 实测 Anthropic Luna Max:额度宽松速度极快 — timpera · 2026-08-28
- 用户吐槽 Grokbot 表现糟糕,任务遗漏严重 — krishnan · 2026-08-28
- Prime Intellect 发布 18 个前沿模型的自主 AI 研究能力评估报告 — mariofilhoml · 2026-08-28
- 模型优化不应只追求思考时的 token 数量 — abacaj · 2026-08-28