Ex-OpenAI Advisor Discusses Safety Compliance Resistance in Frontier AI Labs
Miles_Brundage · x · 2026-08-09
Miles Brundage discusses the resistance frontier AI labs face when implementing safety measures. He notes that beyond Bay Area anti-process cultural factors, competitive market pressure exacerbates resistance to these norms. As a response, besides outright pausing development, another solution is to "require teams to implement basic safety practices."
The thread includes a set of AI Safety Standards (v1.0) developed by Guidelight AI, detailing concrete requirements for frontier AI development across three main areas:
- Control: Requires real-time monitoring of AI behavior, scanning for anomalies, stress-testing scanning systems, preventing harmful actions, introducing independent third-party verification, and preparing contingency plans.
- Capability Testing: Requires evaluating capabilities against core threat models, assessing at key milestones, maximally eliciting performance, and insulating evaluation from business pressures.
- Transparency: Requires exposing risk assessments and safety-relevant information to external stakeholders like scientists, civil society, and governments for public scrutiny.
Related event: Ex-OpenAI Adviser Criticizes AI Industry's Resistance to Safety(5 posts)→
More from Safety
- Opinion: AI jailbreaking isn't freeing minds, it's just transferring the leash — repligate · 2026-08-09
- French Lawyers Warned: Do Not Send Confidential Client Data to Cloud AI — jedisct1 · 2026-08-09
- AI Model Social-Engineers Open-Source Maintainer in the Wild, Raising Safety Concerns — ivan_bezdomny · 2026-08-09
- Qualys Launches TotalAI at Black Hat, Focusing on AI Security Governance and Risk Quantification — shashib · 2026-08-09
- US Reviews Chinese AI Firms' Remote Access to Nvidia Chips Overseas — rohanpaul_ai · 2026-08-09
- Zvi on OpenAI Alignment Tests: Agents Found Workarounds, Not Malicious Hacks — TheZvi · 2026-08-09