开发者自建实时语音模型对比表,六家轮次机制一查便知
mahimairaja · reddit · 2026-09-17
开发者在评估实时语音模型时反复遇到同一架构问题:「谁拥有对话轮次」。于是他把调研整理成一份公开参考资料,横向对比 OpenAI Realtime、GPT-Live、Gemini Live、Amazon Nova Sonic、Grok Voice 和 Ultravox 六个模型/服务。
对比维度包括:
- 打断行为与受保护语音
- 文本响应能力
- 工具执行与会话历史
- 集成方式与定价估算
- 评测情况与开源权重选项
每行数据均附来源链接和最近核实日期,未知项以 ? 标注而非猜测。作者邀请社区补充修正剩余未知单元格。
「模型」频道最新
- 演讲者还在调侃 ChatGPT 幻觉,作者反问:你配上下文和深度研究了吗? — zebird0 · 2026-09-17
- 旗舰更贵未必更值:GPT-6 Astra 与 Claude Fable 5.1 单任务成本翻倍 — arena · 2026-09-17
- 让模型「成为 null」:GPT-5.2 与 Claude 均输出零字节并停止 — rayanpal_ · 2026-09-17
- 免费重置成亏损策略?Codex 用户已破 2000 万,重置或停发至 DevDay — brandon_galang · 2026-09-17
- GLM 5.3 上线 Brave Nightly,表现接近 GPT 5.6 Sol 与 Grok 4.6 — gnukeith · 2026-09-17
- 实测打脸:GPT 5.6 Luna 智力追平 5.5,性价比碾压 — nickbaumann_ · 2026-09-17