Epoch AI 推出综合能力指数 ECI,跨时代比较模型通用能力
ricklamers · x · 2026-10-07
Epoch AI 发布 Epoch Capabilities Index(ECI),把多个 AI 基准测试的得分统一换算成一个「通用能力」标度,解决单一基准快速饱和后无法长期比较模型的问题。
要点:
- ECI 支持按时间、训练算力两个维度绘制前沿模型能力趋势,并提供排行榜与按领域的细分视图。
- 单个 ECI 数值可映射回各基准的具体预期得分:每个基准的拟合曲线是一条 logistic 曲线,曲线越陡说明该基准将快速饱和;分数接近 0% 或 100% 时,基准已难以区分模型强弱。
- 数据以 CC-BY 许可开放下载,便于研究者复用。
「研究」频道最新
- OpenAI 新论文将黎曼 ζ 零点禁区分界推至 Re(s)>7/8 — PTenigma · 2026-10-08
- 曝 OpenAI 黎曼猜想论文有瑕疵,Astra 核查指其未形式化证明有误 — ctjlewis · 2026-10-08
- ZooWork-ShopRanker 开源电商重排器,0.6B 到 8B 三档对齐购物偏好 — kalyan_kpl · 2026-10-08
- LessWrong 思想实验:模型如何在不许说不知道时猜出今天的日期 — LessWrong 精选 · 2026-10-08
- 以太坊研究员 Justin Drake 呼吁行业转入「地堡模式」应对数学进步风险 — marcvanderchijs · 2026-10-08
- Lean 证明疑与论文不一一对应,GPT 形式化被指对难证引理抄近路 — ctjlewis · 2026-10-08