从 o1-preview 到数学超人类只用了两年,RL 突破人类级评测

jam3scampbell · x · 2026-09-09

开发者 jam3scampbell 指出,从 2024 年 9 月 o1-preview 在 AIME 上展现的 test-time scaling 趋势,到如今在一套开放数学难题评测集上达到超越人类的水平,只用了两年——RL 让模型突破人类上限早已是共识,但实时目睹仍然超现实。

他的核心论点:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →