StepFun launches StepAudio 3: five audio models, #1 in realtime speech evals

StepFun_ai · x · 2026-09-16

StepFun has released StepAudio 3, a family of five audio models covering realtime voice, speech recognition, speech generation, audio scene generation, and music.

Related event: StepFun Launches StepAudio 3 Family of Five Audio Models(4 posts)→

Original post →

More from Multimodal

Multimodal channel →