阶跃星辰发布 StepAudio 3:五个音频模型实时语音登顶评测
StepFun_ai · x · 2026-09-16
阶跃星辰(StepFun)发布 StepAudio 3 音频模型家族,共 5 个模型,覆盖实时语音对话、语音识别、语音生成、音频场景生成与音乐生成。
- 主打实时语音 agent 能力:可处理打断、边说边推理、调用工具
- 实时对话模型在 Artificial Analysis 排行上 Conversational Dynamics 达 98.9%、Speech Reasoning 达 99.7%,均列第一
- ASR 词错率(WER)低至 1.7%,追平排行榜最佳成绩
- 模型现已在 StepFun 平台开放使用
所属事件:阶跃星辰发布StepAudio 3:五款音频模型全栈出击(4 条相关)→
「多模态」频道最新
- Pixio 整合 500+ 前沿模型,一个订阅打通图像视频音频与 3D 生成 — tsi_org · 2026-09-16
- 开源音乐模型 YuE2 放宽限制:个人创作者可免费商用 — cocktailpeanut · 2026-09-16
- 开源 LynnReal-Omni:一个模型通吃视频生成/编辑/修复,权重已放出 — AgeNo5351 · 2026-09-16
- Viggle 开源 Meridian:已有视频可改机位、FOV 和子弹时间 — init-5 · 2026-09-16
- MiniMax 在东京办 IP×AI 峰会,发布 H3 IP Edition — MiniMax_AI · 2026-09-16
- 把静态新艺术海报做成动画:首尾帧生成+对齐的完整流程 — dipSlope · 2026-09-16