ScholarCatalyst: a new benchmark testing whether AI can pick research problems like humans

PangWeiKoh · x · 2026-10-02

AI is increasingly making progress on open problems like Navier-Stokes, but defining a new problem still relies on human research taste. ScholarCatalyst is a new benchmark built from AI researchers' firsthand accounts of what inspired their work, designed to evaluate whether AI can replicate that problem-finding judgment rather than just solve given problems.

Related event: ScholarCatalyst Benchmark Measures Research Taste(3 posts)→

Original post →

More from Research

Research channel →