Rabdos 发布数学推理评测,Claude Opus 5 领先

prof_g · x · 2026-08-06

Rabdos AI 推出了 Rabdos Math Index,这是一个旨在全面衡量大模型在证明、求解和感知方面数学推理能力的综合评测基准。

在该榜单中,Anthropic 的 Claude Opus 5 以 47 分位居第一,OpenAI 的 GPT-5.6 Sol 以 41 分紧随其后,而其他所有受测模型的得分均未超过 25 分。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →