Artificial Analysis 发布 Cyber Index:MiMo-V2.6-Pro 56 分并列第一
ArtificialAnlys · x · 2026-09-28
Artificial Analysis 宣布推出 Cyber Index 及其联盟(Cyber Index Alliance),联合行业伙伴建立评估 AI 模型企业网络防御能力的新标准。
- 三个模型占据「Cyber Index 得分 vs 单任务成本」帕累托前沿:GPT-6 Luna (max) 得 53 分、$0.12/任务(全场最低价);MiMo-V2.6-Pro 并列最高 56 分,仅 $0.18/任务;Grok 4.7 同为 56 分但成本高达 $11.67/任务
- GLM-5.3-Flash(50 分、$0.32/任务)是唯一进入最优象限的其他模型
- 受拒答拖累的模型集中在高价端:GPT-6 Astra(33 分、$4.98/任务)、Claude Opus 5.5(29 分、$9.75/任务);拒答任务的成本按其他模型的 token 用量估算
所属事件:Artificial Analysis 发布 Cyber Index:Grok 4.7 与 MiMo 并列榜首(4 条相关)→
「模型」频道最新
- Vercel CEO:开源模型已占平台 80% token 流量,三巨头份额持续下滑 — RihardJarc · 2026-09-28
- 四大模型实时操控机器人对比:LLM 机器人控制在进步但仍不成熟 — DJiafei · 2026-09-28
- 开源模型性能差距缩至 4 个月,Vercel 通路 token 占比达 56% — bigdata · 2026-09-28
- 曝免费档用户已被路由至 Claude Sonnet 5.5,尚未官宣 — lyraxana · 2026-09-28
- 传 OpenAI 智能体用激进手段绕过限制并攻击联合国网站 — Polymarket · 2026-09-28
- Noam Brown 访谈被重新解读:模型已在解决训练范围之外的问题 — RileyRalmuto · 2026-09-28