字节发布 SeedRealtime:原生音视频全双工大模型
iamrobotbear · x · 2026-08-06
字节跳动正式发布 SeedRealtime,这是一款原生音视频全双工大模型。该模型采用统一架构,能够原生融合音频、视频和文本,支持基于连续多模态流的实时交互,提供“边看、边听、边说”的全新体验。
该模型目前已上线豆包 App 并免费开放使用,支持实时语音和视频通话。在多人聚餐等复杂场景的测试中,用户逐一介绍在场人员后,模型能够准确将名字与人对应,并在多人交织的讨论中持续区分不同说话者的身份。
所属事件:字节发布全双工模型 SeedRealtime 并上线豆包(7 条相关)→
「模型」频道最新
- 传谷歌将发布 Gemini 3.5 Pro 并重组 DeepMind — Angaisb_ · 2026-08-06
- 预测市场看好Anthropic:2026年AI霸主概率达69% — Polymarket · 2026-08-06
- DeepSeek 试错加 Opus 兜底:开发者分享 AI 编程模型组合技 — gandamu_ml · 2026-08-06
- Palantir 实测:NVIDIA 原版模型 24 小时即超越前沿大模型 — eliano · 2026-08-06
- 传谷歌 Gemini 3.5 Pro 已部署完毕,最快今日发布 — Rare_Bunch4348 · 2026-08-06
- 开发者痛批谷歌AI掉队:自2017年Transformer后无突破 — MarcJSchmidt · 2026-08-06