Qwen3.8-27B 三值量化版仅需 8GB 显存,号称 500 美元内本地跑强模型
alexcovo_eth · x · 2026-09-19
- 推主 @0xSero 称 PrismML 推出了 Qwen3.8-27B 的三值(ternary)量化版本,体积缩小 9 倍、保留 98.2% 性能,可在 8GB 显存或 16-24GB Mac 内存上运行,整套硬件不到 500 美元。
- 发帖人声称其能力超过 GPT-5.6-Luna High、Opus-4.6-Max、Gemini-3.1-Pro,并与 GLM-5.2 Max、Gemini-3.6-Flash 打平。
- 注意:另有用户实测指出这类极端压缩模型在基准外的真实表现远弱于跑分,存在争议(见另一条帖子)。
「模型」频道最新
- ChatGPT Pro 20 倍套餐恢复发售,此前因算力紧张暂停 — mark_k · 2026-09-19
- OrukLabs 发布 Resonance-2,从音频识别 31 种情绪与说话风格信号 — ChrisGPotts · 2026-09-19
- OpenAI 推法律 AI 产品 Astra for Law,律师质疑 ZDR 数据承诺不可验证 — bgmshana · 2026-09-19
- Noam 原话澄清:攻克千禧年难题非靠多智能体,贡献不足一成 — eliebakouch · 2026-09-19
- LLM logprobs 可当软分类器?一年半前的预言被验证 — JnBrymn · 2026-09-19
- Jev 实测:固定标签分类任务准确率持平现有模型,成本低约百倍 — ivan_bezdomny · 2026-09-19