评论:大厂自建AI安全叙事存在结构性利益冲突
AryHHAry · x · 2026-09-12
作者对 Anthropic 与 OpenAI 的 AI 安全叙事提出结构性批评:竞赛中开发最强 AI 的公司同时最热衷谈论 AI 危险,构成不可避免的利益冲突——类似商业中的监管俘获,规则由大玩家按自身利益书写。
作者主张,仅靠实验室内部的 alignment 研究不够,需要让社区、利益相关方与独立第三方有权监督、审计乃至关停危险系统的治理架构,把伦理嵌入设计本身,而非事后补救。作者称正在尝试构建这样的基础设施。
「漫话AGI」频道最新
- Polymarket 押注 71%:今年内 AI 实验室将宣布再解一道千禧年难题 — Polymarket · 2026-09-12
- 前 Anthropic/OpenAI 研究员称 AI 会自我复制难拔插头,遭网友算账打脸 — basedjensen · 2026-09-12
- 菲尔兹奖得主邓煜放话:AI 若能解出全部数学题就转行写言情小说 — Polymarket · 2026-09-12
- Manifold 上「AI 2030 年前灭绝人类」仅 5%,作者论预测市场对末日风险的局限 — j_foerst · 2026-09-12
- 对冲基金大佬 Ole Lehmann:AI 正在大规模削减招聘,动荡期将至 — MattGarciaEth · 2026-09-12
- Timnit Gebru 称 AI 灭绝论是转移视线,DeepMind 前研究员反驳 — Turn_Trout · 2026-09-12