腾讯 AuK 登顶 Hugging Face 趋势:语音克隆到分离一站式模型
tencent · hf · 2026-09-11
腾讯发布的语音模型 AuK 正在 Hugging Face 上登上趋势榜,属于 text-to-speech 类目。
从标签看其能力覆盖相当广:zero-shot 语音克隆、语音生成与编辑、语音增强,还包括声源分离与说话人分离等音频处理任务,是一个偏全能型的语音模型。
「多模态」频道最新
- ComfyUI 本地实测 Minimax H3:多道具单图参考生成完美无缝循环动画 — Time-Ad-7720 · 2026-09-11
- 153 个 GPT Astra 提示词合集:3D 与游戏案例可一键直出 — TheMoonMidas · 2026-09-11
- DeepSeek V4.1 Flash 多模态:45T 图文 token 预训练加模态级负载均衡 — nrehiew_ · 2026-09-11
- Hailuo 768p 视频本地放大到 2K/4K 仍无好方案? — Infinite-Emptiness · 2026-09-11
- 实测 Astra 能 composing SNES 芯片音乐,vibe coding 游戏又添一员 — AIandDesign · 2026-09-11
- H3 Max 视频端点预告:真假画面边界难辨 — noahsolomon · 2026-09-11