TASTE Benchmark Tests Whether Models Can Predict AI Safety Researchers' Preferences

amankhan · x · 2026-09-08

Anthropic safety researcher Joe Benton is highlighting TASTE (The AI Safety Taste Evaluation), calling it possibly one of the best signals of whether our AIs are on track to be helpful.

Related event: TASTE: New Benchmark Tests AI Models on Safety Researcher Preferences(2 posts)→

Original post →

More from Safety

Safety channel →