audio.cpp 大幅优化:Higgs Audio 显存降 48%,多款 TTS 提速
Acceptable-Cycle4645 · reddit · 2026-10-08
audio.cpp 项目发布一批性能更新,主打让音频模型本地部署更实用:
- Higgs Audio TTS:峰值显存降至约 6GB(降 48%),速度基本持平
- HTDemucs:GPU 上提速 2.21×(Vulkan 1.95×)
- PocketTTS:CPU 提速 2.23×
- 其他模型也有 6–21% 不等的显存节省,如 MOSS-TTS、Qwen3-TTS、IndexTTS2 等
全部为运行时级优化,精度与正确性无损。项目现已支持 110+ 音频模型家族、190+ 变种,覆盖 CUDA、Vulkan、Metal、AMD/HIP 与 CPU。WebUI 新增实验性生成历史功能,团队同时招募前端/UI 贡献者。
所属事件:audio.cpp 大更新:Higgs Audio 显存省 48%(2 条相关)→
「Infra」频道最新
- 腾讯开源 STEPQuant:6-bit 递归状态省 68.7% 推理内存不失精度 — _akhaliq · 2026-10-09
- Bain 预测 2030 年全球 GPU/定制芯片出货 3860 万片,为 2023 年 10 倍 — Beth_Kindig · 2026-10-09
- 多团队共享 GPU 集群:AWS 发布 HyperPod 多租户参考架构 — AWS ML Blog · 2026-10-09
- Mistral 被指弃用核电转用七成煤电数据中心训练开源模型 — wavefnx · 2026-10-09
- 为什么每轮都把完整对话发给推理服务器?Reddit 热议服务端 KV 槽位 API 设想 — Vasili_Sk · 2026-10-09
- NVIDIA NeMo-DCR:1T 模型权重同步从 87.5 分钟压缩到 150 秒,提速最多 40 倍 — dair_ai · 2026-10-09