COLM26 研究:LLM 验证声明靠捷径,并非真正核对证据

deliprao · x · 2026-10-06

deliprao 团队将在 #COLM26 报告一项令人担忧的发现:现代 LLM 在验证科学/医学声明的基准上得分很高,但大多并非真正逐条核对证据,而是走了捷径。

所属事件:UPenn研究:前沿LLM验证科学声明走捷径致约束错误全漏(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →