Minimax H3 生成 20 种语言女性问候视频,展示多模态能力
SIR_NVAX_A_LOT · reddit · 2026-08-27
作者使用 Minimax H3 模型生成了 20 位不同女性用 20 种方言问候世界的视频。视频采用 I2VA 技术,分辨率 832x480,int8 量化,20 步推理。作者承认视频中存在明显的 AI 运动瑕疵(如 1:07 处的旋转),并邀请提问。
「多模态」频道最新
- Google 发布 Gemini Omni 1.1 Flash:视频生成带入 Veo 创作控制 — AIwithGhotai · 2026-08-28
- 谷歌推 Gemini Omni 1.1 Flash:支持 4K 升级与 10 秒场景扩展 — GoogleAI · 2026-08-28
- 谷歌发布 Gemini Omni 1.1 Flash:支持 4K 升级与场景扩展 — GoogleAI · 2026-08-28
- Runway Dev 平台上线 WAN 3.0,支持多模态音视频生成 — tlakomy · 2026-08-28
- Seedance 2.0 视频生成低至 $0.026/秒,Dreamina 价格比别家低 76% — azed_ai · 2026-08-28
- 开发者自制浏览器扩展:让 ComfyUI 视频带元数据上传 Civitai — diogodiogogod · 2026-08-27