本体引导GRPO提升图推理

gaganghotra_ · x · 2026-07-11

帖子概述了一项研究结果:前沿大模型容易被“故事”带跑偏,而小模型更能正确读图/读结构。

研究方法是用 ontology-guided GRPO 训练 Gemma 4B 做知识图谱推理,帖子还提到有 field notes 作为补充材料。核心观点是:借助本体引导,可以提升小模型在图结构推理上的表现。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →