VoiceMem双脑记忆框架将语音AI检索延迟压至134毫秒

南洋理工大学谢之非一作、颜水成通讯的联合团队(含清华、港中文等高校及 OpenInteractionLab)发布面向实时语音交互的流式双脑记忆框架 VoiceMem。该框架针对长期记忆检索会给语音 Agent 引入 50-200 毫秒以上延迟、影响对话体验的痛点,将记忆检索延迟压缩到 134 毫秒,让实时语音 Agent 能近零延迟地理解用户,论文与代码已开源。

2026-09-07 ~ 2026-09-07 · 2 条相关