Fish Audio 发布 S2.1 Pro 语音模型主打低延迟
Fish Audio 发布了面向生产环境的实时语音与克隆模型 S2.1 Pro。该模型主打约 90ms 的首音超低延迟,支持覆盖 83 种语言,仅需 5 到 10 秒的音频样本即可高保真复制人类声音。官方还表示其运行速度是竞品的两倍,而价格仅为 ElevenLabs 的六分之一。
2026-07-29 ~ 2026-07-29 · 4 条相关
- Fish Audio 推出 5 秒克隆声音模型,称价格仅为 ElevenLabs 的六分之一 — JafarNajafov · 2026-07-29
- Fish Audio 说 S2.1 Pro 可在 90ms 内起声,覆盖 83 种语言 — testingcatalog · 2026-07-29
- Fish Audio 语音克隆只需 10 秒样本 — aryanXmahajan · 2026-07-29
另有 1 条近重复转述:testingcatalog