GOLLuM Fixes LLM Overconfidence in Science via Uncertainty Training

bravo_abad · x · 2026-08-29

Addressing LLM overconfidence in science, GOLLuM trains a language model jointly with a Gaussian process to learn from experimental outcomes under uncertainty.

Key Results:

In contrast, prompting GPT-5, Gemini, and Claude to optimize directly showed failure rates up to 80% due to hallucinated molecules, duplicates, and invalid suggestions.

Original post →

More from Research

Research channel →