Qwen3.8-27B 推出 GSQ-RCO SOTA 量化版

Loginhe · reddit · 2026-08-29

IST-DASLab 实验室发布了基于 GSQ(Gumbel-Softmax 量化)和 RCO(黎曼约束优化)方法的 Qwen3.8-27B GGUF 量化模型。新方法在 2.5-3.0 bpw 极低比特下实现了接近 BF16 基座模型的精度,并在 AIME25 等基准上取得优异成绩。模型兼容 llama.cpp、Ollama 和 LM Studio。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →