AA 智能指数被质疑:Sonnet 5.5 竟高于 fable 5.1
Ill_Distribution8517 · reddit · 2026-10-01
Reddit 用户质疑 Artificial Analysis 智能指数的可信度:Sonnet 5.5 在指数上得分高于 fable 5.1,但实际用过两个模型的用户几乎不会认为前者更聪明。作者指出该指数约 30% 权重来自人类评分的「商业设计品味」,认为这使其难以准确衡量智能水平,并征集其他用户的实测体验。
「模型」频道最新
- 曝 Gemini 4 Argon token 效率不佳,早期口碑转冷 — adonis_singh · 2026-10-01
- Polymarket:谷歌年终领跑 AI 概率 40%,Gemini 4 Argon 曝百万 token 输出 — Polymarket · 2026-10-01
- 网友盘点 Opus 5.5 反复出现的「盖章」句式,称其为新 delve — dylfreed · 2026-10-01
- Pedro Domingos 断言:基于 token 的定价模式将很快过时 — pmddomingos · 2026-10-01
- ChatGPT 突发大规模宕机,大量用户无法使用 — Polymarket · 2026-10-01
- 用户吐槽 Google 新模型发布节奏:先内测再 $200 门槛 — zacharynado · 2026-10-01