Gemma+决策头混合架构:Jetson 上实现低延迟多人语音对话

cortexist · reddit · 2026-09-29

作者展示一个解决真实语音交互核心难题(人脑不是 LLM,不会回应听到的每句话)的混合架构 demo:

对做端侧语音 agent 的人有参考价值:把"何时插话"和"说什么"拆成两个模型是控制延迟的关键做法。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →