Gemini 4 Argon 幻觉率仅15%,宁拒答不编造
i_dg23 · x · 2026-10-01
- Artificial Analysis 数据显示 Gemini 4 Argon 幻觉率低至 15%,对比 Grok 4.7 为 29%、GPT-6 Astra 45%、Opus 5.5 59%、Fable 5.1 69%。
- 正确率上 Argon(50%)仍不及 Opus 5.5 max(66%),但其特点是不知道答案时会明确说不知道,而不是编造。
- 该数据来自第三方评测转述,正式上手体验尚未有,真实表现待验证。
所属事件:Gemini 4 Argon 评测出炉:智能追平 GPT-6 Astra 且便宜四成(10 条相关)→
「模型」频道最新
- 博主一句话评价:GPT-6.1 Sol 被低估了 — mallow610 · 2026-10-01
- 「最便宜的模型其实是Opus 5.5」:省人时才是真成本 — CamBrazy3 · 2026-10-01
- 港中文系统实验揭示循环语言模型何时真正有效 — CUHK-CSE · 2026-10-01
- 27B 本地模型实测:Dirk-Qwen3.8 全面碾压 Swift-1.5 同底模 — norenEnmotalen · 2026-10-01
- KOL 预热 Gemini 4 Argon:要么封神,要么刷榜到没法用 — thatroblennon · 2026-10-01
- Reddit 热议:用户凭什么为 OpenAI 的失败实验产品买单 — dagerika · 2026-10-01