AA 智能指数被质疑:Sonnet 5.5 竟高于 fable 5.1

Ill_Distribution8517 · reddit · 2026-10-01

Reddit 用户质疑 Artificial Analysis 智能指数的可信度:Sonnet 5.5 在指数上得分高于 fable 5.1,但实际用过两个模型的用户几乎不会认为前者更聪明。作者指出该指数约 30% 权重来自人类评分的「商业设计品味」,认为这使其难以准确衡量智能水平,并征集其他用户的实测体验。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →