27B 模型 Faraday:用长视界 RL 复现论文

teortaxesTex · x · 2026-08-17

Inherent Labs 发布了 Faraday,这是一个 27B 参数的“AI 科学家”,旨在复现 AI 研究论文的结果。它通过长视界强化学习进行训练,在复现任务上超越了 Claude Opus 和 GPT-4 等模型。分析指出,Faraday 的进步主要不在于写代码,而在于具备了“科学品味”——即决定做哪个实验、判断何种证据有效以及识别代码捷径的能力。其 RL 设置将难以量化的“做好研究”转化为可训练的评判任务,利用特定指标和层级信用分配来学习长轨迹中的有效决策。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →