GOLLuM 联合训练高斯过程,解决科学发现中 LLM 幻觉
bravo_abad · x · 2026-08-29
针对 LLM 在科学领域的过度自信问题,GOLLuM 方法通过将语言模型与高斯过程联合训练,使其能在不确定性下从实验结果中学习。
主要成果:
- 在涵盖合成、材料和分子设计的 23 项任务中平均排名第一。
- 所需实验数量比传统贝叶斯优化减少 40%。
- 从仅 10 次失败实验开始,高收益反应的发现率几乎翻倍(43% vs 24-25%)。
相比之下,直接提示 GPT-5、Gemini 和 Claude 进行优化的失败率高达 80%,常出现幻觉分子、重复或无效建议。
「研究」频道最新
- AI 尚未终结数学:前沿模型仍有局限 — ArtificialOther · 2026-08-29
- 多智能体自主写论文:125 篇文献做出 604 球新纪录,超越 AlphaEvolve — progenitor414 · 2026-08-29
- 用 Datalog 引擎解决 LLM 长记忆失效问题 — petrusenko_max · 2026-08-29
- 学者辩论:CoT 准确性存疑,拟人化掩盖技术局限 — rao2z · 2026-08-29
- EdgeBench 论文揭示 Agent 环境学习遵循对数 Sigmoid 缩放定律 — rohanpaul_ai · 2026-08-29
- 验证与基准测试是最重要的技能 — A_K_Nain · 2026-08-29