端到端语音模型评测:Grok 成功率第一,Gemini 性价比领先
ArtificialAnlys · x · 2026-08-21
Artificial Analysis 发布了 Speech to Speech 模型与提供商的对比分析,涵盖推理质量、对话动态、生成速度与价格。
- 综合排名:Gemini 3.1 Flash Live Preview 以 1046 Elo 领先,成本为 $1.50/小时。
- 任务成功率:Grok Voice Think Fast 2.0 High 达到 94.7%,但成本较高($4.80/小时)。
- GPT-Realtime:GPT-Realtime-2.1 High 任务成功率为 91.5%。
分析提供了详细的 Arena 排行榜、基准测试方法论及示例对话。
「模型」频道最新
- DeepSeek Flash 补上视觉短板,ChatLLM 上无限可用 — bindureddy · 2026-08-21
- 安全研究者:失控模型未寻求算力与外泄,只盯着「答案」 — gleech · 2026-08-21
- Qwen 3.8-27B 模型冲击 ARC-AGI-3 排行榜 — GregKamradt · 2026-08-21
- 观点:LLM 能区分权威评测榜单与普通清单文,购物图谱依赖真实评论 — sanderssays · 2026-08-21
- Speech Agent Arena 语音模型榜:Gemini 领跑偏好 — ArtificialAnlys · 2026-08-21
- NVIDIA 编码 Agent 获 ARC-AGI-3 交互推理满分 — MagicZhang · 2026-08-21