通义发布 UniSwap:统一流式音视频身份替换模型

QwenBusinessUnit · hf · 2026-08-14

阿里 Qwen 团队发布了 UniSwap 模型,该模型专为说话人视频(Talking Videos)设计,能够实现同步的外观与声音替换。

UniSwap 采用统一的流式音视频扩散 Transformer 架构,并配合专门的训练与推理适配方案,从而在视频生成过程中保持高质量的音画同步与身份特征转换。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →