Ex-OpenAI Researchers: Unified Third-Party AI Safety Evaluators Nearly Impossible
Former OpenAI researchers Su Sheng and Steven Adler argue that frontier labs will almost certainly never agree on a single third-party safety evaluator, as the role requires capabilities, independence, and lab acceptance that are nearly impossible to satisfy simultaneously.
2026-09-13 ~ 2026-09-13 · 3 related posts
- Suchenzang: near-zero odds labs agree on a credible third-party safety evaluator — suchenzang · 2026-09-13
- Ex-OpenAI researcher: odds near zero labs agree on a real third-party safety evaluator — basedjensen · 2026-09-13
- Ex-OpenAI researcher: labs will never agree on one third-party safety evaluator — suchenzang · 2026-09-13