ECCV MMBU 基准揭示:视觉语言模型答对题却认不出图像模态
davidjhwu · x · 2026-09-24
前沿视觉语言模型在生物医学问题上常给出看似可信的答案,但实际并不知道自己在看什么。ECCV 上的 MMBU 基准显示,模型经常答案正确,却无法识别图像的模态、身体部位或染色类型,暴露出生物医学 AI 的感知瓶颈。
- 竞赛:MMBU Challenge 设置 3 个赛道,提供超过 10 万美元算力与奖金,赛期为 10 月 1 日至 12 月 31 日
- 报名延期至 9 月 30 日
- 由 @gxlai、Anthropic、Stanford AI Lab 等支持
「多模态」频道最新
- Kijai 优化 MiniMax H3 视频 VAE:N卡编码提速 2.2 倍 — Lexius2129 · 2026-09-24
- AI 视频首登大银幕:WVLNGTH Brighton 四天后上映九位创作者作品 — LudovicCreator · 2026-09-24
- GPT-6-Sol 像素画测试改用 PixiJS 渲染器,效果大幅提升 — burny_tech · 2026-09-24
- Claude Opus 5.5 写出巴赫风格赋格,LLM 音乐已可纯欣赏 — repligate · 2026-09-24
- Claude 一次生成整支 MV:P(doom) 音乐视频源码开源 — trq212 · 2026-09-24
- 作者逆向 Qwen Image 2.1 PE,开源节点自动解析宽高比 — BleynSpecnaz · 2026-09-24