Weaviate 1.39 推出 4-bit 旋转量化,堆内存再省 45%
CShorten30 · x · 2026-09-17
Weaviate 1.39 为旋转量化(RQ)新增 4-bit 支持:在保持与 8-bit 相近召回率的同时,将堆内存占用降低约 45%,且导入更快、全库搜索性能提升。
技术要点:
- 底层基于 Extended-RaBitQ,用 Fast Walsh-Hadamard Transform(FWHT)实现快速随机旋转;1.39 为 FWHT 加了 SIMD 支持,与 Go 参考实现逐位一致但显著提速。
- 旋转、距离核、编码与内存路径全面优化,8-bit RQ 在 1.39 中导入速度提升 16%,仍是 Weaviate Cloud 的默认选项。
- 博客还讨论了 RQ 随数据规模增长的召回表现,以及与 TurboQuant 的对比。
对以内存和成本为先的场景,4-bit RQ 现已可用,配套博客详解了实现细节。
「Infra」频道最新
- Nebius GB300 NVL72 整机架登顶 MLPerf:DeepSeek R1 每秒 60.3 万 tokens — demian_ai · 2026-09-18
- 新论文:三指标路由器让 16GB 消费级 GPU 长上下文 RAG 零 OOM — chaumian · 2026-09-18
- 曝 Meta 自研芯片 MTIA 450 将于 2027 上半年进入数据中心 — Beth_Kindig · 2026-09-18
- 华为发布 Peerium 架构与 Atlas 960E SuperPoD:百万卡如一台机器 — pstAsiatech · 2026-09-18
- SemiAnalysis:智能体流量已占全部推理流量超 70% — NinaDSchick · 2026-09-18
- Qwen Flash打破「大内存」迷信:组合式PC架构重新成立 — sn2006gy · 2026-09-18