Ref2V 展示:H3 模型 15 秒生成复杂提示词效果
Jeffu · reddit · 2026-08-26
作者分享了使用 Ref2V 方法(基于 H3 模型)生成的视频片段,展示了模型在仅 15 秒内处理复杂提示词的能力。
「多模态」频道最新
- OraRL:高效可扩展的视频 MLLM 强化学习 — Yunheng Li · 2026-08-26
- 如何快速生成MiniMax高清视频?求不牺牲质量方案 — OkMeat6773 · 2026-08-26
- 用 Google Gemini 生成女孩仰望天空蓝鲸的感人动画 — michaelrabone · 2026-08-26
- AI 生成舞蹈视频展示炫酷动作效果 — No-Bookkeeper-char · 2026-08-26
- ECCV 2026 新研究:Face Anything 实现任意序列 4D 人脸重建 — rsasaki0109 · 2026-08-26
- GPT Image 2 神级 Prompt:将日常照片转化为形状翻译海报 — RealJamesOfficial · 2026-08-26