CoinVE-Edit 发布:一次前向传播执行 5 条视频编辑指令
pmttyji · reddit · 2026-08-20
HuggingFace 上发布视频编辑模型 CoinVE-Edit,基于 Wan2.1-T2V-14B(DiT)与 Qwen3-VL-8B(MLLM 编码器)构建,支持组合式多指令视频编辑:单次前向传播同时处理 2–5 条编辑指令,每条指令通过轻量 mask 头注入区域感知引导,确保各编辑严格限制在对应空间区域内。
支持替换、添加、删除、更换背景等操作任意组合,同时保持整体视频连贯性。模型在 CoinVE-200K 数据集(20 万+ 高质量视频-编辑对,经严格数据过滤)上训练。
所属事件:腾讯 CoinVE-Edit 视频编辑模型与 CoinVE-200K 数据集亮相(2 条相关)→
「多模态」频道最新
- Dreamina 趣图:一键生成“环绕地球”的动态视觉特效 — umesh_ai · 2026-08-20
- H3TiledLoopSpaceTime 展示基于 H3 的时空视频生成 — DuHal9000 · 2026-08-20
- MiniMax H3上线Magnific:单提示词混用9图3视频3音频 — AIwithGhotai · 2026-08-20
- 实测 MiniMax H3:单提示词处理长序列视频生成效果佳 — egeberkina · 2026-08-20
- each::labs 发布 Video API,提供 39 种视频后处理模型 — thetripathi58 · 2026-08-20
- AI 视频工具实测:Runway 现实感强,Luma 运动自然 — Acrobatic_Show_9092 · 2026-08-20