GPT 5.6文档理解评测

llama_index · x · 2026-07-10

LlamaIndex 对 OpenAI 新发布的 GPT 5.6 做了 ParseBench 的 day 0 测试,用来评估它在文档理解上的改进。结果显示,新模型家族在文本和表格阅读上继续表现出色,但在图表和版式理解上仍然吃力。

帖子还提到,Luna 约为 Sol 的 1/6 成本,但在 ParseBench 各项指标上只带来轻微下降,说明更多推理 token 并不一定带来成比例的视觉理解提升。

所属事件:LlamaIndex评测称GPT-5.6文档理解能力较前代无显著提升(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →