幻觉率对比:Gemini 4 Argon 15%,远低于 GPT-6 Astra 51% 与 Opus 5.5 66%

brandon_galang · x · 2026-10-01

AA-Omniscience 幻觉率基准显示三家旗舰模型差距悬殊:Gemini 4 Argon 仅 15%,GPT-6 Astra 51%,Opus 5.5 高达 66%。Brandon Galang 评价:虽警惕 Gemini 的刷榜倾向,但这一表现足以让 Argon 成为企业聊天场景首选——对普通用户来说,模型说「我不知道」远好过编造答案,"知道何时闭嘴"才是终极基准。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →