业内讨论 VLM 与 MLLM 术语定义差异
TimDarcet · x · 2026-08-25
帖子针对学术界和工业界混用 VLM、MLLM 等术语的现象进行了澄清。作者指出 CLIP 类模型通常被称为 VLM,而像 LLaVA 这样基于 LLM 接受图像输入的模型应称为 MLLM 或 VLLM。强调在科研沟通中应保持术语的精确性,追溯其历史起源。
「研究」频道最新
- 《Post-Training AI》前两章草稿上线:几百行代码跑通 SFT 与 GRPO — ben_burtenshaw · 2026-08-25
- 新创推 Physical AI:万亿参数 4D 物理模拟架构 — mark_k · 2026-08-25
- 医学期刊发文警示社媒上“未经同行评审”的 AI 信息 — EricTopol · 2026-08-25
- Anthropic 开源 Claude 设计的蛋白质结合剂数据集 — huggingface · 2026-08-25
- Seurat 5.6 发布:用 Coding Agents 重写核心 — arjunrajlab · 2026-08-25
- 北大提出 RAG 上下文分配定律与闭环编排法 — PekingUniversity · 2026-08-25