PRIMESCIENTIST 让研究智能体学会分配实验预算,奖励提升 10.3%
rohanpaul_ai · x · 2026-09-27
- 核心思路:研究智能体不应把预算全部押在一条思路上,而应选择把实验花在哪里。PRIMESCIENTIST 同时维护多个可执行计划构成的树,实验结果回传更新各分支价值,再由分配策略动态调度——资源充裕时广探索,预算收紧时聚焦强分支。
- 实测成绩:在 12 个 FIRE-Bench 任务上,平均奖励比 AutoResearch 高 10.3%,实验尝试次数少 50.6%(同等 token 预算下);全量评测中 24 个任务里有 23 个用的尝试次数更少。
所属事件:PrimeScientist 用 MCTS 分配实验预算,研究智能体奖励提升 10.3%(2 条相关)→
「编程与Agent」频道最新
- 用 Muse 机器人闯 SAINTCON 迷宫赛,数千个 64x64 迷宫实战 — tristanbob · 2026-09-27
- The New Stack:企业 AI Agent 缺失的平台层何在 — blaizedsouza · 2026-09-27
- AI Agent 重踩分布式系统旧坑:双写问题详解 — blaizedsouza · 2026-09-27
- 用 Base44 与 Opus 5.5 做出整座大学校园 3D 交互地图 — tristanbob · 2026-09-27
- Anton Zhiyanov 出品 Go 并发交互式小书,浏览器内可跑示例 — blaizedsouza · 2026-09-27
- 开发者开源 lowdown-proxy:让 MCP 智能体共享工具使用历史 — art2meta · 2026-09-27