网友质疑:若测试框架一致,Opus 泛化能力优于 GPT-5

umike_njsf · x · 2026-07-30

网友 @umikenjsf 针对 Claude Opus 与 GPT-5 的评测争议发表看法。他认为,如果两者的分数都是基于相同的通用 ARC 测试框架得出的,那么对比依然成立。这也意味着,即便不考虑额外的优化手段,Opus 在泛化能力上确实表现得比 GPT-5 更好。

所属事件:Claude Opus的ARC-AGI高分被指受API实现影响(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →