Grok Imagine “Omni” 据称将支持图像视频音频输入
mark_k · x · 2026-07-28
有帖子称 Grok Imagine “Omni” 要来了,来自 @SpaceXAI。
这个版本被描述为 Grok Imagine 的多模态形态:可以接收 图片、视频片段和音频,再生成更有电影感的视频。原帖还把它类比为 Google Omni 或 Flux 3,并表示希望同时会带来一个新模型。
如果属实,这意味着 Grok Imagine 会从单一生成器扩展成一个支持跨模态输入的视频创作工具。
所属事件:曝 xAI Grok Imagine 升级多模态创作流(3 条相关)→
「模型」频道最新
- 有人认为 Anthropic 只是在模型领先上略占薄边 — intellectronica · 2026-07-28
- Google Gemma 4 Vision 的 token budget 演示在 Hugging Face 走红 — google · 2026-07-28
- 作者称 GPT 5.6 Ultra 做 Agent 过于不稳定 — tensorqt · 2026-07-28
- SimpleQA 实测里 Firecrawl 以 94.7% 领先 Exa 和 Claude 搜索 — Candid-Dog-775 · 2026-07-28
- Kimi 价格大概率被协议设了下限 — op7418 · 2026-07-28
- SingularityAPI 把多款开源模型封装进统一 OpenAI 兼容接口 — Individual_Team_2344 · 2026-07-28