MoralityBench: AI morality leaderboard finds model moral answers vary wildly across runs

NakedPlato · reddit · 2026-10-05

MoralityBench.ai is a new leaderboard adapting moral psychology tests into an AI benchmark. The notable finding: except for one model (Jev), models show considerable variance in their moral answers across repeated runs — suggesting moral judgment in LLMs is not deterministic. The leaderboard is live, with comparison charts published alongside.

Original post →

More from Models

Models channel →