Fish Audio 语音模型 S2.1 Pro 限时全免,成本仅竞品六分之一
rohanpaul_ai · x · 2026-07-30
Fish Audio 宣布其语音克隆模型 S2.1 Pro 限时免费开放一个月。该模型仅需 10-15 秒音频即可克隆声音,支持 83 种语言,响应延迟低至约 90ms,且支持发音和停顿的词级控制。
架构与生态:底层采用 Dual-AR 设计(40亿参数负责语义与情感,4亿参数处理声音细节),兼顾了速度与表现力。模型基于其开源项目 Fish Speech 构建,仍提供可自托管的开放权重模型。价格方面,其成本约为 ElevenLabs 的六分之一。
核心优势:该模型专为真实对话场景设计,能够从容应对打断、纠正、笑声及语言切换等复杂情况。
所属事件:Fish Audio发布S2.1 Pro语音模型并获5200万美元融资(11 条相关)→
「模型」频道最新
- 谷歌发布 Gemini Robotics ER 2 具身推理模型 — rseroter · 2026-07-31
- MoE模型Inkling-Small发布:276B参数性能不减 — ziqiao_ma · 2026-07-31
- OpenAI 宣布模型大降价,性能最高提升 5 倍 — Just_Lingonberry_352 · 2026-07-31
- OpenAI 发布 GPT-5.6:Luna 版降价 80%,Terra 版降价 20% — kiki-le-koala · 2026-07-31
- OpenAI 降价抹平中国开源模型优势,或将吞噬市场 — arrakis_ai · 2026-07-31
- 实测:Kimi K3 模型成功在普通家用地下室 PC 上本地运行 — Yuchenj_UW · 2026-07-31