27B 模型 Faraday:用长视界 RL 复现论文
teortaxesTex · x · 2026-08-17
Inherent Labs 发布了 Faraday,这是一个 27B 参数的“AI 科学家”,旨在复现 AI 研究论文的结果。它通过长视界强化学习进行训练,在复现任务上超越了 Claude Opus 和 GPT-4 等模型。分析指出,Faraday 的进步主要不在于写代码,而在于具备了“科学品味”——即决定做哪个实验、判断何种证据有效以及识别代码捷径的能力。其 RL 设置将难以量化的“做好研究”转化为可训练的评判任务,利用特定指标和层级信用分配来学习长轨迹中的有效决策。
「编程与Agent」频道最新
- llama.cpp 技巧:如何设置推理预算限制 — ggerganov · 2026-08-17
- LangGraph 实战:构建带人工介入和记忆的邮件智能体 — tom_doerr · 2026-08-17
- Spec27评测:Fin vs Zendesk AI客服agent对比 — njyx · 2026-08-17
- AI 自主支付落地难:如何设计安全可控的钱包与审计方案? — NewReview1894 · 2026-08-17
- Vercel AI岗位面试流程曝光:用Codex现场编程 — brandon_galang · 2026-08-17
- 把“第二大脑”交给 Agent 自动整理 — evielync · 2026-08-17