ComfyUI 集成 Gemini Omni Flash 1.1,支持 4K 视频生成
osanseviero · x · 2026-08-28
ComfyUI 宣布首发支持 Google 的 Gemini Omni Flash 1.1 模型。通过 Gemini Video Omni 节点,用户可在一个节点内完成多种任务:
- 生成与编辑:文生视频、图生视频、参考生视频、指令编辑、场景扩展。
- 高分辨率:最高支持 4K 输出,并自动生成音轨。
- 多模态输入:同时接受文本、图像和视频输入。
该模型原生的多模态处理能力保证了输出的一致性,并支持对话式视频编辑。
「多模态」频道最新
- SpatialCrafter:单图生成可控 3D 场景视频 — kwangmoo_yi · 2026-08-28
- 实测腾讯 Hy4 图像生成:精细绘制盆景与光影 — vincent_koc · 2026-08-28
- Midjourney 提示词技巧:用“不完美”叙事渲染奢华余韵 — tisch_eins · 2026-08-28
- 开源图像/视频/音频生成工具 PotionUI 招募早期测试者 — 0roborus_ · 2026-08-28
- 用社区 LoRA 让 MiniMax 生成 Seedance 级打斗镜头 — Beginning-District69 · 2026-08-28
- ECCV 2026 论文:视频模型推理发生在去噪步骤而非帧间 — liuziwei7 · 2026-08-28