HeyGen 联手 OpenAI 开源实时 AI 语音数字人框架
9 月 11 日,HeyGen 宣布与 OpenAI 密切合作,开源一套构建实时 AI 体验的参考框架,并声称「实时 AI 体验问题已被解决并开源」,同时附上日语家教场景的演示 Demo。该消息由 HeyGen 官方发布,altryne、aftahiai 等多个账号随后转述。
已确认
- 框架由三个组件组合而成:GPT-Live-1(OpenAI 的全双工语音到语音模型)、LiveAvatar/TryLiveAvatar(带面孔的实时语音数字人智能体)以及 HyperFrames。
- HeyGen 官方以 MIT 协议开源了 liveavatar-gpt-live-demos 仓库,展示 GPT-Live 驱动 LiveAvatar 的最小可读参考集成。
- 官方发布了会教学的实时语音数字人演示(日语家教 Demo)。
为什么重要
- 该框架将 OpenAI 的全双工语音模型与 HeyGen 的实时数字人形象结合,并完全开源参考实现,大幅降低了构建实时语音数字人交互产品的门槛。
- HeyGen 官方高调宣称「实时 AI 体验已被解决」,若实际体验达到宣称水平,可能推动语音数字人在教育、客服等场景加速落地。
2026-09-11 ~ 2026-09-11 · 5 条相关
一手来源
- HeyGen 联合 OpenAI 开源实时 AI 语音头像框架,附日语家教 Demo — HeyGen ·
- HeyGen 开源 LiveAvatar × GPT-Live 参考实现:会教学的实时语音数字人 — HeyGen ·
- 【源头】HeyGen 联合 OpenAI 开源实时 AI 语音头像框架,附日语家教 Demo — HeyGen · 2026-09-11
- HeyGen联合OpenAI开源实时AI互动框架GPT-Live-1 — altryne · 2026-09-11
- 【源头】HeyGen 开源 LiveAvatar × GPT-Live 参考实现:会教学的实时语音数字人 — HeyGen · 2026-09-11