audio.cpp 大更新:Higgs Audio TTS 显存省 48%,支持 110+ 音频模型
Acceptable-Cycle4645 · reddit · 2026-10-08
本地音频推理项目 audio.cpp 发布一批运行时级性能优化,不牺牲输出正确性:
- Higgs Audio TTS:峰值显存降至约 6GB,减少 48%,是本次最大亮点
- HTDemucs:CUDA 下提速 2.21×,Vulkan 下 1.95×
- PocketTTS:CPU 提速 2.23×,RAM 减少 9%
- 其他:MOSS-TTS 克隆省 21% 显存、Qwen3-TTS 省 16-20%、IndexTTS2/2.5 省 12%、ACE-Step 提速 1.06-1.20×
WebUI 新增实验性的生成历史功能,可回看历史输出并恢复其设置。项目现已支持 110+ 音频模型家族、190+ 变体,覆盖 CUDA、Vulkan、Metal、AMD/HIP 和 CPU。团队正在招募前端/UI 贡献者改进 WebUI。
「Infra」频道最新
- AI 工程师进阶清单:从提示工程到 KV 缓存、量化与 Agent 护栏 — ghumare64 · 2026-10-08
- Hugging Face Buckets 视频教程:Xet 底层只传缺失块省带宽 — lhoestq · 2026-10-08
- 开源训练实录:EDA 优于 GDN-2,连续 7 次主机故障自动切换专家 — jon_durbin · 2026-10-08
- 内蒙古乌兰察布已建/规划 89 座数据中心,中国掀起 AI 算力竞赛 — pstAsiatech · 2026-10-08
- 高可用不等于没宕过机:可用性的本质是故障时的韧性设计 — Franc0Fernand0 · 2026-10-08
- 4x RTX PRO 6000 私有 AI 工作站交付,起价 2.6 万美元主打数据不出门 — dee_hw · 2026-10-08