Fish Audio 发布 S2.1 Pro 语音模型主打低延迟

Fish Audio 发布了面向生产环境的实时语音与克隆模型 S2.1 Pro。该模型主打约 90ms 的首音超低延迟,支持覆盖 83 种语言,仅需 5 到 10 秒的音频样本即可高保真复制人类声音。官方还表示其运行速度是竞品的两倍,而价格仅为 ElevenLabs 的六分之一。

2026-07-29 ~ 2026-07-29 · 4 条相关

另有 1 条近重复转述:testingcatalog