Grok Voice Think Fast 2.0发布:语音推理与降噪能力大幅跃升
XFreeze · x · 2026-07-30
SpaceXAI 发布了其目前最强大的语音到语音模型——Grok Voice Think Fast 2.0。该模型在多项核心指标上表现亮眼:
- 总体语音到语音质量指数达到 82.9%,语音推理得分 97.2%,智能语音任务得分 56.5%。
- 首次音频响应延迟仅为 0.70秒,且仅消耗 1.0 版本 0.4倍的推理 token。
在真实场景的听写能力上取得了显著突破。在覆盖 24 种语言的数千个短语测试中,其转录准确率比 Deepgram Nova 3 和 ElevenLabs Scribe v2 高出 1.5 到 2 倍;在嘈杂环境或压缩通话中,优势更是扩大至约 10 倍。
此外,模型支持“边说边推理”,允许在完成首句前就开始工具调用且不增加延迟。该模型将于 8 月 5 日成为默认的 grok-voice-latest 模型,定价为 0.08美元/分钟。SpaceXAI 已将其部署于 Starlink 客服线路,显著提升了销售转化率与问题解决率。
所属事件:xAI发布Grok Voice Think Fast 2.0,抗噪与推理全面升级(15 条相关)→
「模型」频道最新
- 网友惋惜:Opus 5 还没发力就被截胡了 — chrisfirst · 2026-07-30
- Claude 遭遇重大服务宕机,全量业务受到中断影响 — Polymarket · 2026-07-30
- 预测市场:年底拥有最强 AI 模型的概率,OpenAI 领先 Meta 仅 12% — Polymarket · 2026-07-30
- 专家澄清:Kimi K3 自我迭代非模型进化,仅是 Agent 优化测试框架 — dotey · 2026-07-30
- 第三方团队将 Kimi K3 推理提速至近 80 TPS,超越官方 API — bittingthembits · 2026-07-30
- Kimi K3赋能Cline:Terminal Bench得分升至88.8% — ccerrato147 · 2026-07-30