Fish Audio 语音克隆只需 10 秒样本
aryanXmahajan · x · 2026-07-29
Fish Audio S2.1 Pro 被介绍为面向开发者的语音克隆模型,只需 10 秒语音样本 就能复制一个人的声音。
- 它强调能保留 语调、节奏、情绪和口音,并支持 83 种语言。
- 模型支持 实时流式输出 和 开发者 API,帖子里还写到对开发者免费。
- 作者列出的应用场景包括 AI 销售外呼、客服、双语播客、游戏角色和实时语音产品。
所属事件:Fish Audio 发布 S2.1 Pro 语音模型主打低延迟(4 条相关)→
「多模态」频道最新
- 泄露时间表显示多款视频模型将在一周内密集发布 — koltregaskes · 2026-07-29
- 一款本地 iPhone 修图应用开启 beta,主打端侧视觉模型 — measure_plan · 2026-07-29
- Gemini Flash 把一张机器人“崩溃脸”做成了梗图 — Bishopkilljoy · 2026-07-29
- 开源应用用 Gemini 视频理解自动提取高光短片 — icnahom · 2026-07-29
- 研究者希望 agent 任务结束后直接生成短视频摘要 — airesearch12 · 2026-07-29
- WAN Bernini 加 Prompt Relay 让 10–15 秒视频更可控 — Sudden_List_2693 · 2026-07-29