Hermes Index 完整榜单:头部贵得有理,尾部模型成本仅 5 美分

NousResearch · x · 2026-10-07

Nous Research 公布 Hermes Index 各模型成绩与单任务成本:同一 harness、推理强度尽量拉满,报告四套基准的平均分与平均成本。

结论指向清晰:头部模型得分差距明显,而性价比端与能力端差距同样巨大——Sonnet 5.5 以不到 Opus 6 成的价格拿到 53 分,尾部 Flash 模型以近零成本换低分。

所属事件:Nous Research 发布 Hermes Index 智能体榜单,Claude Opus 5.5 居首(4 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →