开发者发布 Qwen3.8-Flash 低比特量化:保留 95% 精度且长上下文不衰减

Crampappydime · reddit · 2026-10-02

Reddit 用户发布了自己制作的 Qwen3.8-Flash base 低比特量化版本(Hugging Face: DJLougen/Qwen3.8-Flash-Next-Mooney)。

所属事件:开发者将 180B 模型塞进单台 DGX Spark(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →