自研全栈模型:印度市场 AI 语音 agent 延迟降至 700ms

--demigod-- · reddit · 2026-08-21

一款针对印度呼叫经济学设计的 AI 语音 agent 平台介绍。核心技术特点包括:全栈自研(LLM、TTS、ASR 均非套壳)、自建电信层(非租用 SIP trunk)。这种组合将延迟控制在 700ms 左右,成本约每分钟 2 美元,以适应印度市场。默认使用约 30B 参数模型以保证速度,复杂场景可切换大模型但会增加延迟与成本。作者寻求社区测试,关注点包括语音自然度、停顿感、插话处理及多语言发音准确性。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →