开发者质疑 LLM 排行榜:GPT 5.6 Sol 强于 Opus 5?

antirez · x · 2026-08-28

开发者 antirez 质疑某 LLM 评测指标的可信度,指出排行榜前两名(GPT 5.6 Sol 和 Opus 5)的排序与实际体验不符,认为该榜单数据存在混乱,建议仅将其作为参考信号之一。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →