RSI-Exam 榜单更新:Fable 5.1 空降第二,GPT-6-astra 仍居首

airesearch12 · x · 2026-09-19

评测项目 RSI-Exam 更新榜单,新增三个前沿模型成绩:Anthropic 的 Fable 5.1 以 0.4813 直接位列第二,Meta 的 Muse Spark 与字节 Seed 的 Seed-Evolving-0909 也一并上榜;OpenAI 的 GPT-6-astra 仍以 0.5126 排名第一。截至本版发布,仍没有任何模型达到 frontier-calibrated 参考线。发帖人询问是否将该榜单收录进 benchmarkheaven 的评测列表。

所属事件:RSI-Exam 排行榜更新:GPT-6-astra 居首,Fable 5.1 空降第二(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →