阶跃星辰发布StepAudio 3:五款音频模型全栈出击

阶跃星辰(StepFun)于 9 月 15 日发布 StepAudio 3 系列,一次性推出五款音频模型,覆盖实时语音对话、语音识别(ASR)、语音生成(TTS)、音效/环境声生成与音乐生成。主打实时语音 agent 交互的模型在 Artificial Analysis 等评测中登顶,ASR 达到 1.7% WER,低延迟流式 TTS 支持实时对话。API 文档同步上线,显示音频 AI 竞争正转向全栈体系化较量。

2026-09-15 ~ 2026-09-16 · 4 条相关