Fish Audio发布S2.1 Pro:90ms低延迟支持83种语言
testingcatalog · x · 2026-07-29
Fish Audio 推出面向生产环境的语音模型 S2.1 Pro,主打实时对话场景。
核心特性:
- 超低延迟:首音延迟约 90ms,足以支撑流畅的实时语音对话。
- 多语言与音色保持:单一音色可覆盖 83 种语言。
- 内联情感控制:支持通过类似 [whispers sweetly] 的自由格式括号标签直接控制语音情绪。
- 语音克隆:仅需 10-30 秒参考音频即可克隆音色。
- 开发者友好:提供免费测试层,并支持 MCP 与 agent-skill 方便集成进语音工作流。
所属事件:Fish Audio 发布 S2.1 Pro 语音模型主打低延迟(4 条相关)→
「模型」频道最新
- GPT-5.6 Sol Ultra 找到严重漏洞,却拒绝展示细节 — haltakov · 2026-07-29
- 转发称 Kimi K3 在基准榜上压过 Anthropic 模型 — JarnoDuursma · 2026-07-29
- 用户实测 Grok 生成能力大幅提升:10 分钟完成创作 — djcows · 2026-07-29
- 用户要求 Anthropic 先修好再弃用 Opus 4.6 — oyacaro · 2026-07-29
- Claude Code 隐藏技巧:手动指定调用旧版 Opus 模型 — voooooogel · 2026-07-29
- Claude Sonnet 3 将在 7 月 30 日退场 — repligate · 2026-07-29