实测Gemini Omni理解手机拍摄视频
voice_of_the_future · reddit · 2026-07-06
用户使用 Gemini Omni 模型对自己用手机拍摄的素材进行视频理解测试,展示该模型在多模态视频理解上的实际表现。Gemini Omni 是 Google 的全能多模态模型,支持视频/音频/图像的统一理解。
「多模态」频道最新
- 零编程经验者用 ChatGPT 开发 ComfyUI 安卓客户端将上架 — ComfierUI · 2026-09-11
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11