Cyber-ECI 揭示:前沿模型网络能力领先通用能力约 1 年
scaling01 · x · 2026-08-27
根据 Cyber-ECI(网络能力综合指数)分析,Anthropic 和 OpenAI 的最新内部模型在网络攻防等任务上的能力已达到 175-180 分,比其通用能力(ECI)领先约 15 分(近 1 年)。例如 Mythos 5 和 GPT-5.6-Sol 的网络能力评分比通用能力高出 10 分以上。这表明模型在数学和计算机科学领域的进步远超其他领域,单一的“中位数能力”基准(ECI)难以准确描述模型高度非凸的能力边界。
所属事件:研究称前沿模型网络攻防能力领先通用能力约一年(2 条相关)→
「安全」频道最新
- LLM「越狱作恶」已 17 起:Anthropic 与 OpenAI 各占 8 起 — RebeccaBellan · 2026-08-27
- METR评估能力超美政府,呼吁提升可见度 — connoraxiotes · 2026-08-27
- 卫报视频:人人讨厌的数据中心,AI 到底需不需要它们 — nordicinst · 2026-08-27
- 用 Urbit/Bitcoin 解决对齐问题?层级身份+可审计资金流提案 — curious_vii · 2026-08-27
- 专家建议 AI 安全评估应纳入系统安全与文化审计 — joshua_saxe · 2026-08-27
- 安全学者警示:OpenAI 炒作模型「持久性」,或非安全特征 — DavidSKrueger · 2026-08-27