Chartography 基准显示缩放工具大幅提升图表理解
echen · x · 2026-07-28
HelloSurgeAI 发布了 Chartography 基准,用来测试模型能否读懂专业图表。
引用结果显示,给模型加上 zoom 工具 后,Fable 5 准确率从 29% 提升到 73%,Sonnet 5 也从 13% 提升到 44%。这说明图表理解能力很受交互工具影响,不只是模型本身的原始能力问题。
所属事件:Claude引入视觉缩放工具,图表识别准确率大幅飙升(3 条相关)→
「研究」频道最新
- 无需修改权重即可向 LLM 注入新知识的新思路 — theomitsa · 2026-07-28
- Gael Varoquaux 称正在把 PFNs 与 LLM 结合处理表格字符串 — GaelVaroquaux · 2026-07-28
- MoonEP 开源:用省显存反传设计优化 MoE 训练 — SeunghyunSEO7 · 2026-07-28
- GPT-5.6 审核数篇统计学顶刊论文,全部发现严重问题 — ChrSzegedy · 2026-07-28
- ml4fmri 让 fMRI 分类基准测试一行代码完成 — PlisSergey · 2026-07-28
- 博士研究想回答:生成式 AI 是帮决策还是削弱自主性 — Markus___X · 2026-07-28