腾讯混元开源 AuK 语音模型,生成与编辑快如魔法
bingxu_ · x · 2026-09-23
腾讯混元(Tencent Hunyuan)开源了音频生成模型 AuK。用户反馈其音频生成与编辑体验非常流畅、响应极快,「几乎像魔法一样」。
该帖同时引出一个开放问题:开源语音生成模型的质量与 ElevenLabs 这类闭源商用产品相比究竟如何?开源模型的快速迭代正在缩小与闭源方案的差距。
「多模态」频道最新
- 图生视频一镜到底从平静到灾难级场面,umesh_ai 演示 escalation prompt — umesh_ai · 2026-09-23
- 用 MiniMax H3 生成完整恐怖 MV,唇形同步偶有瑕疵 — Kylie-Elena190 · 2026-09-23
- 腾讯混元 Image3.5 预览版上线 OnSolo,会员免费两周 — TencentHunyuan · 2026-09-23
- 实测 invideo AI 编辑器:一句话让 Agent 接管整条预告片音效 — LudovicCreator · 2026-09-23
- 192 张图同题对比:Qwen Image 2.1 vs Krea 2 实测图库公开 — dh7net · 2026-09-23
- 内容创作者吐槽:给 YouTube 缩略图生成夸张表情仍然很难 — jackedAJ · 2026-09-23