Qwen3.8-27B PrismaAqua量化实测:性能逼近BF16
offgridai · reddit · 2026-08-18
作者测试了Qwen 3.8 27B的5.5-bit PrismaAqua量化版本,主要针对工具调用、商业推理和投资分析等特定工作负载。在RTX 5090上使用vLLM进行测试,结果显示该量化模型在自定义测试套件中表现接近BF16全精度版本,工具调用准确率达95%。作者发现设置"medium"级别的推理比"xhigh"更有效,能避免过度思考导致的Token超限问题,同时维持高质量输出。文章还分享了具体的vLLM启动参数。
「模型」频道最新
- Fable 自动数据清洗翻车:错用模板致模型退化 — cephaloform · 2026-08-18
- SemiAnalysis爆料:Anthropic最强模型Mythos2已训完遭雪藏,被用来冲Mythos3 — 新智元 · 2026-08-18
- AI 学者 Zak Kohane 亲测:自写文字被 5 款检测器全判为 AI — zakkohane · 2026-08-18
- Sakana AI 推出日文推理模型 Namazu — hardmaru · 2026-08-18
- 称 DeepSeek V4 加 J-Space 插件后超越 Fable — jmorant555 · 2026-08-18
- 全本地运行:用 Qwen 搭建 AI 自动播客与频道 — sysadmin420 · 2026-08-18