Ex-Omni-2D:具备原生视觉表现力的全模态对话模型

Haoyu Zhang · hf · 2026-08-12

Ex-Omni-2D 是一个全新的全模态对话框架,能够生成高度协同的文本、语音和视频回复。该系统通过构建视觉思维计划,并结合经过蒸馏的流式视频生成器来实现富有表现力的交互。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →