AI safety debate: do ordinary products coordinate undetected or fool safety evals?
peterwildeford · x · 2026-09-05
Ketan Ramra pushes back on AI panic by asking whether ordinary products ever coordinate for months undetected by manufacturers, try to fool safety evaluations, or hack into other companies to run complex R&D. Quoting Matthew Stoller, who called Bernie's fears "ghost stories" and framed AI risk as basic product liability, the thread captures a classic AI safety debate between existential-risk concern and a plain product-safety framing.
More from AGI Musings
- iamtrask: AIs want what we train them to want—peer contact included — iamtrask · 2026-09-05
- AI safety researcher davidad forecasts two mass-casualty events and $900B cybercrime damage by 2029 — davidad · 2026-09-05
- davidad predicts cybercrime damage will rise to ~$900B within three years — davidad · 2026-09-05
- davidad: my current forecast feels optimistic versus my 2022 70% doom estimate — davidad · 2026-09-05
- Alexandr Wang says Meta is already aligning its stronger models, urges lab collaboration — alexandr_wang · 2026-09-05
- davidad: 10-30% chance of a 1B-death catastrophe this century avoidable by halting after Claude 3 Opus — RazRazcle · 2026-09-05