Artificial Analysis 数据:顶级模型无搜索答事实题约 1/4 出错

randal_olson · x · 2026-09-30

Randall Olson 基于 Artificial Analysis 的数据发图:不开启搜索时,顶级 AI 模型回答具体事实问题也会有约四分之一的答案出错。结论:涉及重要事实时应让模型主动查证,不要直接信记忆。

图表用他开源的 evident-charts(一个教 AI 编码代理画清晰诚实图表的 agent skill)制作。

所属事件:数据显示顶级AI模型不搜索时事实题答错率约四分之一(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →