前沿模型首次在财报预测上跑赢人类专家共识
maithra_raghu · x · 2026-10-09
Samaya AI(研究者 Maithra Raghu 团队)发布新研究:前沿 AI 模型首次在金融预测任务上超越人类专家。
核心发现
- 团队构建了 Earnings Predictions(财报预测)环境,最新的前沿模型(Opus 5.5、Fable 5.1、Astra)配合 Samaya 的 harness,在公司营收、毛利率等常报指标上显著跑赢专家共识预测。
方法严谨性
- 在 harness 中设置「point-in-time」时间门,确保无信息泄漏;配套的金融检索与数据工具同样遵守该门,模型只能获取当时专家可得的信息。
- 对专家共识的偏差做了校正,构建了更难的 bias-corrected 基线——只有最新前沿模型能战胜这个硬基线,作者认为这是 AI 金融能力的转折点。
后续方向
- 与此前的 FrontierFinance 类似,模型在不同 rollout 间误差波动大,说明 RL 训练仍有很大提升空间;团队正继续用财报预测等任务做后训练,并开放合作与 alpha 版本试用。
所属事件:前沿AI模型财报预测首次跑赢人类专家共识(2 条相关)→
「漫话AGI」频道最新
- 45 人因安全与伦理顾虑公开离开前沿 AI 实验室 — birchlse · 2026-10-09
- Colm 大会 keynote:LLM 是以人类数十年创造力为食的「魔法生物」 — yoavgo · 2026-10-09
- 一人上线 44123 篇论文,Burkov 讽刺式致谢引热议 — burkov · 2026-10-09
- 研究者:GLM 5.3 未引发攻击潮不代表风险论错了,能力会扩散 — dhadfieldmenell · 2026-10-09
- 社科研究者反思:超过半数仍迷信同行评审这道门禁 — RexDouglass · 2026-10-09
- David Hadfield-Menell:该关注能力使用成本,而非权重是否开源 — dhadfieldmenell · 2026-10-09