新研究:让 LLM 提假说贝叶斯定实验,数据效率大增
rohanpaul_ai · x · 2026-08-16
研究发现,让 LLM 智能体自主选择实验并拟合机制的数据效率较低。论文提出模型发现智能体 (MDA),将 LLM 作为假说生成器,配合贝叶斯推断评分和信息价值选择实验。
在 FORCEBENCH 测试中,MDA 仅用 8 次实验即达到 Opus 4.7 智能体约 41 次实验的精度,数值通过率从 31% 提升至 93%。MDA 在预测失败时会要求 LLM 提出新机制并循环迭代,让 LLM 提出科学想法,由显式不确定性实验决定存亡。
所属事件:新研究将 LLM 假说生成与贝叶斯推断结合加速科学发现(3 条相关)→
「研究」频道最新
- ECCV 2026 将举办第三届 3D HUMANS 研讨会 — dimadamen · 2026-08-18
- TogetherAI 开源 XoRL:消除训练推理误差,提升 MoE 模型 RL 性能 — PandaAshwinee · 2026-08-18
- SegDAC:用动态对象令牌提升视觉 RL 泛化性 — GlenBerseth · 2026-08-18
- 实测揭示上下文压缩是陷阱,提示词缓存完胜 — AI Engineer · 2026-08-18
- 佐治亚理工 2026 版 LLM 课程:覆盖 MoE、自博弈 RL 与扩散语言模型 — cocoweixu · 2026-08-18
- Hugging Face 发布 3.5 万条模型卡摘要数据集,千条成本仅 0.43 美元 — vanstriendaniel · 2026-08-18