全开源视频多模态模型 VideoChat3 发布
VideoChat3 是一款完全开源的视频多模态大模型,旨在解决现有开源视频模型泛化能力有限和效率偏低的问题。该模型主打高效与通用的视频理解能力,不仅提供了模型演示,还面向视频理解任务开放了完整的资源与配套学术论文,为视频多模态研究提供了新的开源工具。
2026-07-17 ~ 2026-07-18 · 3 条相关
- 全开源视频多模态模型 VideoChat3 — MCG-NJU · 2026-07-17
- 开源视频理解模型 VideoChat3 — _akhaliq · 2026-07-18
- VideoChat3 论文链接 — _akhaliq · 2026-07-18