新基准测 VLM 画 ASCII 图

East-Muffin-6472 · reddit · 2026-07-20

ASCIITermDraw-Bench 是一个新的基准,用来测试视觉语言模型能不能正确生成和编辑 ASCII 图。作者认为,ASCII 图在表达架构、网络拓扑、集群关系时很实用,而这和“把图描述出来”不是一回事。基准一共包含 80 个任务,分成四类:基础方框布局、网络拓扑、软件架构图,以及基于图片输入的图编辑。评测时同时看结构分数和 LLM 语义裁判分数,并对每题重复 5 次,再给出 95% 置信区间。当前榜单里,Gemma-4-31B-IT 领先,其后是 Qwen3.7-Plus、Kimi-K2.6、MiniMax-M3、Qwen3.5-9B 和 Ternary-Bonsai-27B。

所属事件:ASCIITermDraw-Bench评测VLM画ASCII图(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →