Grok 写诗 + Grok Imagine 生图 + Veo 生视频:一条链路做出情绪短片
creatoroff · x · 2026-10-01
创作者展示了一条多模型创作链路:用 Grok 生成短诗,Grok Imagine 的 Speed 模式生成图像,Google Veo 生成视频,再用 Topaz 做画质增强,最终完成一支充满情绪的氛围短片。展示了多个生成工具串联合作的可行工作流。
「多模态」频道最新
- ThinkV2V:先思考再编辑,5B 视频编辑模型在复杂指令上胜过 10B 基线 — Donghao Zhou · 2026-10-01
- 复旦 IDSpect:按偏旁部首拆字给奖励,提升中文文字生成结构准确率 — Fudan-University · 2026-10-01
- Imagine3D-LLM 让多模态模型先「脑补」3D 场景再答题 — kaist-ai · 2026-10-01
- JHU 新作 PowerSim:让重建场景可直接物理交互与形变渲染 — anand_bhattad · 2026-10-01
- 7000 张 Midjourney 图+Suno 配乐,Opus 5.5 全权创作 2 小时成本仅 6.8 美元 — ciguleva · 2026-10-01
- Sony AI 等发布 ST-AudioLM:一次建模声音语义与声源移动轨迹,代码已开源 — mittu1204 · 2026-10-01