爆料称 Grok Imagine 将升级为多模态一体创作流
XFreeze · x · 2026-07-28
据爆料,xAI 正在为 Grok Imagine 准备一次很大的升级,内部名为 Imagine Omni。
它的目标是把图片、视频、音频和多种参考素材整合进一个统一的创作流程里,重点能力包括:
- 用 @ 参考锁定角色,保证每个镜头里脸和服装一致
- 支持附加 sprite sheet 和静态图
- 直接上传或录入声音
- 在同一段视频里混合多个参考
- 在整段序列中维持角色身份和视觉一致性
这类能力针对的是 AI 视频最难的问题之一:连续性/一致性。如果落地,创作者可以先定义好角色、声音和视觉参考,再在一个工作流里直接生成完整片段,而不用在多个工具之间反复修补。
「多模态」频道最新
- NVIDIA Sol-Attn 让视频生成端到端提速最高 5.08 倍 — songhan_mit · 2026-07-28
- 西班牙语AI媒体生成视频教程系列上线,从基础到进阶 — Botoni · 2026-07-28
- ACE-Step UI 号称可本地生成 4 分钟带人声歌曲 — anselm · 2026-07-28
- Reddit 用户用 LoRA 和 ComfyUI 做出 Wan 2.2 连续生成流程 — SnooMacaroons1365 · 2026-07-28
- 用户分享一个 Midjourney 新风格及其提示词参数 — azed_ai · 2026-07-28
- 120 张标注图训练出一个 5MB 的 McBess 风格 LoRA — Winter_unmuted · 2026-07-28