GPT-6 两款模型幻觉率均显著低于前代

ArtificialAnlys · x · 2026-09-23

Artificial Analysis 线程续帖:在 AA-Omniscience 基准上,GPT-6 Sol 与 Luna 在 max effort 下的幻觉率均明显低于各自前代(Sol 92%→60%,Luna 93%→77%)。

所属事件:Artificial Analysis 深度评测 GPT-6:价格腰斩、幻觉率大降但 GDPval 回退(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →