JigShape基准:揭示VLM在几何推理上的严重缺陷
Shawn Li · hf · 2026-08-12
提出了一种名为 JigShape 的全新拼图基准测试,用于评估视觉语言模型(VLM)的视觉几何推理能力。研究发现,当前的 VLM 在几何推理方面表现不佳,且随着拼图尺寸的增加,性能会出现急剧下降。
「研究」频道最新
- 单张图像重建铰接物体:视觉语言融合新框架 — snu · 2026-08-12
- DistilVDR:524M 参数小模型逼近 8B 检索能力 — nanovdr · 2026-08-12
- AdvFD:引入对抗特征空间提升图像生成质量 — Kwai-Kolors · 2026-08-12
- AI 智能体仍无法胜任开放式研究:缺乏判断力与回溯能力 — mikeflache · 2026-08-12
- 一个公式解决大模型训练与推理不匹配问题 — willccbb · 2026-08-12
- EigenLabs 打造野外多智能体科研环境 — gajesh · 2026-08-12