Ex-Omni-2D:具备原生视觉表现力的全模态对话模型
Haoyu Zhang · hf · 2026-08-12
Ex-Omni-2D 是一个全新的全模态对话框架,能够生成高度协同的文本、语音和视频回复。该系统通过构建视觉思维计划,并结合经过蒸馏的流式视频生成器来实现富有表现力的交互。
「多模态」频道最新
- Flux 3 视频模型实测:生成 1990 年风格怪兽录像 — CurieuxExplorer · 2026-08-12
- Wan 3.0 实测:物理逻辑大幅提升,支持 30 秒长视频 — Fresh-Resolution182 · 2026-08-12
- 开源 MiniMax H3 优化套件:显存占用直降 25% — Fantastic-Equal-1696 · 2026-08-12
- MiniMax H3 Turbo LoRA 发布:768p 4 步生成 — jugernaut126 · 2026-08-12
- 通义万相 3.0 登陆 OpenArt,支持 12 种语言原生文字渲染 — Alibaba_Qwen · 2026-08-12
- 跳过阿里云配置:通过聚合 API 调用 Wan 3.0 实战指南 — Practical_Low29 · 2026-08-12