Cartesia 观点:语音 AI 的关键或是连续状态而非语音
rohanpaul_ai · x · 2026-09-22
- 作者指出 AI 领域一个奇怪假设:同一模型架构应同时擅长「思考」与「交互」,但语音模型的工作很特殊——它不仅要给出正确答案,还要在人持续说话、序列不断变长的情况下跟上节奏。
- 他认为在语音 AI 中,「语音」可能不是应对难点的正确抽象,「连续状态」(continuous state)才是,并引出 Cartesia 的相关探讨,完整内容见其 YouTube 视频《The Neon Show》。
所属事件:Cartesia 创始人:语音 AI 难点在持续状态而非语音(2 条相关)→
「模型」频道最新
- Grok 4.7 曝光:开源世界城市游戏对比显示远强于 4.6 — belce_dogru · 2026-09-22
- tiny 分类模型 Jev 对打 Claude 全家桶:自测文本理解不落下风 — vesko_st · 2026-09-22
- 自建防背诵基准实测:微型分类模型 Jev 达 Sonnet 水平、便宜约 150 倍 — vesko_st · 2026-09-22
- HLE 榜单:Grok 4.7 居第 21,Gemini 3.8 与 Muse 1.3 领跑 — himanshustwts · 2026-09-22
- 马斯克官宣 Grok 4.7:主打高智能、速度快、成本低 — tetsuoai · 2026-09-22
- Grok 4.7 编码实测翻车:Terminal-Bench 4.0 成绩难看 — daniel_mac8 · 2026-09-22