阿里发布 Qwen3.8-Flash-Next:成本极低且性能强悍

The Decoder · rss · 2026-08-26

阿里发布 Qwen3.8-Flash-Next,预览 Qwen4 架构。这是一个混合专家模型,每个 Token 仅激活 6B 参数(总参数 125B)。在 1/9 训练成本下,其编码和办公基准测试成绩击败了 DeepSeek-V4-Flash 和 Claude Opus 4.6 等更大模型,进一步加剧 OpenAI 和 Anthropic 的价格压力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →