Hermes Index 由四套基准构成,含全新自研 Hermes Bench
NousResearch · x · 2026-10-07
Nous Research 说明 Hermes Index 的构成:对四个基准取平均,其中一个是新自研的 Hermes Bench,其余为 Terminal-Bench 4.0、Terminal-Bench-Science 和 SkillsBench。
所属事件:Nous Research 发布 Hermes Index 智能体榜单,Claude Opus 5.5 居首(4 条相关)→
「编程与Agent」频道最新
- OpenAI Decisions API 支持图像输入,13 美分挑出 40 分钟素材最佳表情 — stevenheidel · 2026-10-07
- Embedder 单条提示词 1 小时完成 nRF52 到 nRF54 固件迁移 — ycombinator · 2026-10-07
- Brain Co 推出面向 AI Agent 的设计系统 Synapse,把设计判断写进组件 — LVidegaray · 2026-10-07
- 开发者称旧 vibe coding 工作流反成劣势:直接说需求即可 — TheMoonMidas · 2026-10-07
- 开发者更新 Lerna 插件:Copilot CLI 可动态路由至微软 Foundry — unixterminal · 2026-10-07
- 观点:智能体正处「捆绑期」,下一波将是窄场景专用 Agent — signulll · 2026-10-07