豆包全量上线 SeedRealtime:原生全双工边看边聊免费开放
xiaohu · x · 2026-08-05
字节跳动 Seed 团队发布原生音视频全双工大模型 SeedRealtime,现已全量上线豆包 App,用户更新至最新版即可免费使用。
相比以往依赖级联系统或纯语音端到端模型,新架构将画面与声音统一交由同一模型处理,从而更精准地判断用户是否说完,大幅减少了打断或冷场情况。官方同步放出了 7 段实拍演示,展示了其在嘈杂环境(如机场、多人聚餐)下的抗干扰与精准识人能力。
所属事件:字节发布全双工模型SeedRealtime(3 条相关)→
「多模态」频道最新
- RTX 3060 跑 Minimax H3 生成 15 秒需 1.5 小时,开发者求助本地优化 — SMPTHEHEDGEHOG · 2026-08-05
- Midjourney V8.2 新风格实测:附具体提示词 — azed_ai · 2026-08-05
- SDXL 模型 NVFP4 量化实测:HSWQ 方案显著优于原生量化 — Zestyclose_Bake3680 · 2026-08-05
- 长提示词反损画质?论文揭示文生图文本控制新解法 — rohanpaul_ai · 2026-08-05
- AI 辅助制作高质量 MV:音频与角色参考工作流 — Previous-Street8087 · 2026-08-05
- Minimax H3 实测:该节点组合比 Spectrum 更快 — audax8177 · 2026-08-05