Qwen3.8-Flash 支持本地运行,125B 模型仅用 75GB 内存

danielhanchen · x · 2026-08-26

Unsloth 宣布 Qwen3.8-Flash 现已支持本地运行。这是一个 125B 参数的多模态 MoE 模型,基于 Qwen4 架构预览,性能超越 Claude-4.6-Opus (Max)。

核心亮点:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →