阶跃星辰发布 StepAudio 3:5 款音频模型,ASR 达 1.7% WER
StepFun_ai · x · 2026-09-16
阶跃星辰(StepFun)发布 StepAudio 3 系列共 5 款音频模型,覆盖实时语音对话、语音识别、语音生成、音效/环境声生成与音乐生成。
- 实时模型在 Artificial Analysis 榜单的对话自然度(98.9%)与语音推理(99.7%)两项均排名第一
- ASR 词错率低至 1.7%,追平榜单最佳成绩
- 面向语音 agent 场景:支持打断处理、边说边推理、调用工具
- 支持中、英、日、韩、法、西等多语言(实时对话暂为中英)
模型已可通过 API 使用,并配套 Voice Studio 试用环境。
所属事件:阶跃星辰发布StepAudio 3:五款音频模型全栈出击(4 条相关)→
「模型」频道最新
- Cartesia 新语音模型家族获赞:WER 之外提出语境正确性评测思路 — buckymoore · 2026-09-16
- 网友复现评测:GPT-Astra 无思维链计算能力出现质的飞跃 — dhadfieldmenell · 2026-09-16
- Anthropic Astra 成消费金额榜首,OpenAI Luna 以代币用量大幅领先 — gdb · 2026-09-16
- DeepSeekMath-V2 把验证做成产品:验证算力随生成器一起扩展 — le_james94 · 2026-09-16
- ChatGPT Plus「Work Projects」失联 bug 三天未修,OpenAI 却已关单 — OnwardUpwardForward · 2026-09-16
- 曝 Google 打造数学特化模型 Gemini DeepThink Mathematica — basedjensen · 2026-09-16