一个评测 VLM 画 ASCII 的新基准

East-Muffin-6472 · reddit · 2026-07-19

这是一个名为 ASCIITermDraw-Bench 的新基准,用来测试 VLM 是否真的能按要求生成和编辑 ASCII 图。

作者的动机是:很多模型能“说”出架构图或拓扑图长什么样,但把这些内容准确排成 ASCII 文本,是另一种更难的能力。为此基准设计了 80 个任务,覆盖四类场景:

评测方式也比较完整:

当前榜单里,Gemma-4-31B-IT 以 73.8% 领先,其后是 Qwen3.7-Plus(70.2%)、Kimi-K2.6(61.8%)、MiniMax-M3(59.5%)等。项目公开了 12 个示例任务和完整方法,作者也提供了 Hugging Face 上可复现的内容。

所属事件:ASCIITermDraw-Bench评测VLM画ASCII图(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →