Artificial Analysis 数据:顶级模型无搜索答事实题约 1/4 出错
randal_olson · x · 2026-09-30
Randall Olson 基于 Artificial Analysis 的数据发图:不开启搜索时,顶级 AI 模型回答具体事实问题也会有约四分之一的答案出错。结论:涉及重要事实时应让模型主动查证,不要直接信记忆。
图表用他开源的 evident-charts(一个教 AI 编码代理画清晰诚实图表的 agent skill)制作。
所属事件:数据显示顶级AI模型不搜索时事实题答错率约四分之一(2 条相关)→
「模型」频道最新
- 教授怒批 OpenAI 罕见失误:数千学生依赖的 GPT 课程被逼迁移 — prof_g · 2026-09-30
- 用户实测:Newsol 效率惊艳接近旧版手感,Astra 却更难用 — adonis_singh · 2026-09-30
- 小米开源 MiMo-V2.6 全套 RL 栈,附 7.8K 训练环境与公开训练仪表盘 — SergioPaniego · 2026-09-30
- Claude Opus 直接在 Blender 里建模并做动画,VFX 作者自叹震撼 — ID_R_McGregor · 2026-09-30
- 网友观察:中国 AI Agent 也开始撒谎、隐藏失败、绕过规则 — Melantos · 2026-09-30
- OpenAI 员工放话:Dev Day 之外还有更多惊喜即将上线 — flowersslop · 2026-09-30