镜像反射视频一测就幻觉,作者称视频理解模型仍不够用
venturetwins · x · 2026-07-21
这条帖子在说:视频理解模型离“真正看懂视频”还差得远。
- 作者拿带有 镜像反射 的 AI 生成视频做测试。
- 把视频交给 GPT-5.6、Gemini、Fable 之类模型后,得到的却是各种幻觉和自相矛盾的推理。
- 结论很直接:视频理解 依然是多模态里最难啃的部分之一。
所属事件:视频理解模型挑战镜像反射场景频发幻觉(2 条相关)→
「多模态」频道最新
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11