字节发布 SeedRealtime:原生音视频全双工大模型

iamrobotbear · x · 2026-08-06

字节跳动正式发布 SeedRealtime,这是一款原生音视频全双工大模型。该模型采用统一架构,能够原生融合音频、视频和文本,支持基于连续多模态流的实时交互,提供“边看、边听、边说”的全新体验。

该模型目前已上线豆包 App 并免费开放使用,支持实时语音和视频通话。在多人聚餐等复杂场景的测试中,用户逐一介绍在场人员后,模型能够准确将名字与人对应,并在多人交织的讨论中持续区分不同说话者的身份。

所属事件:字节发布全双工模型 SeedRealtime 并上线豆包(7 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →