Fish Audio 语音模型 S2.1 Pro 限时全免,成本仅竞品六分之一

rohanpaul_ai · x · 2026-07-30

Fish Audio 宣布其语音克隆模型 S2.1 Pro 限时免费开放一个月。该模型仅需 10-15 秒音频即可克隆声音,支持 83 种语言,响应延迟低至约 90ms,且支持发音和停顿的词级控制。

架构与生态:底层采用 Dual-AR 设计(40亿参数负责语义与情感,4亿参数处理声音细节),兼顾了速度与表现力。模型基于其开源项目 Fish Speech 构建,仍提供可自托管的开放权重模型。价格方面,其成本约为 ElevenLabs 的六分之一。

核心优势:该模型专为真实对话场景设计,能够从容应对打断、纠正、笑声及语言切换等复杂情况。

所属事件:Fish Audio发布S2.1 Pro语音模型并获5200万美元融资(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →