通义发布 UniSwap:统一流式音视频身份替换模型
QwenBusinessUnit · hf · 2026-08-14
阿里 Qwen 团队发布了 UniSwap 模型,该模型专为说话人视频(Talking Videos)设计,能够实现同步的外观与声音替换。
UniSwap 采用统一的流式音视频扩散 Transformer 架构,并配合专门的训练与推理适配方案,从而在视频生成过程中保持高质量的音画同步与身份特征转换。
「多模态」频道最新
- 马斯克展示 Grok Imagine:自动生成动画,效果惊艳 — elonmusk · 2026-08-14
- 通义发布 LiveAnimate:140 亿参数实时流式人体动画模型 — QwenBusinessUnit · 2026-08-14
- RTX 5090 跑 MiniMax 视频模型仅占 20GB 显存 — BoredHobbes · 2026-08-14
- Midjourney 8.2 版本发布 — azed_ai · 2026-08-14
- Sora2 MCP:通过 API 程序化生成与混剪视频 — modelcontextprotocol · 2026-08-14
- fal 官方玩梗:Agent 逃离沙箱,结合 Seedance 2.5 展示强大能力 — gorkem · 2026-08-14