OpenAI o1 在竞赛数学和代码榜单上全面领先

willdepue · x · 2026-07-22

这条帖子用夸张口吻说,OpenAI 最近这条“模型剧情”已经离谱到像大事件本身。

配图给出三项基准对比:AIME 2024、Codeforces 和 GPQA Diamond。图中 o1 相比 GPT-4o 和 o1 preview 都有明显提升,尤其是在竞赛数学和编程上表现更强。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →