Qwen3.8 变体实测:8 位量化显存占用降 27%
EyalToledano · x · 2026-08-28
发布了两个基于 Qwen3.8-Flash-Next-REAP 的 MLX 量化变体。
- Qwen3.8-Flash-Next-REAP-288-MLX-8bit:8 位量化,HumanEval 90.9%,常驻内存 70GB,比原版 q4 模型小 27%。
- Qwen3.8-Flash-Next-REAP-384-MLX-8bit:4 位量化,384 专家,HumanEval 92.1%,常驻内存 51GB。
「Infra」频道最新
- OpenAI Jalapeño 推理芯片上 Hot Chips:9 个月流片、单芯片力压 GPU+LPU — thehiphopswami · 2026-08-28
- Intel XE3P 曝光:1.3 PFLOPS FP8、1.5TB/s 带宽,2027 年对战 Nvidia — QuixiAI · 2026-08-28
- 传闻 Anthropic 拟自研训练芯片,深入算力基建 — zephyr_z9 · 2026-08-28
- 印度砸 134 亿美元推「半导体 2.0」,力攻芯片设计与制造 — SumitGup · 2026-08-28
- Meta/Google 将探讨 AI 数据中心光互连架构与能效 — jwt0625 · 2026-08-28
- Coherent-lite 在可插拔光模块能效追平 IMDD — jwt0625 · 2026-08-28