博客长文批 Anthropic:安全承诺随竞争压力一再松动
TheMoonMidas · x · 2026-09-10
Moon Midas 发表长文解释「为什么我不信任 Anthropic」。核心论点:一家警告人类风险的公司应当接受更多审视,尤其是它仍要继续建造这项技术。
关键事实与论证:
- 承诺随竞争改变:2026 年 2 月 24 日,Anthropic 重写了其负责任扩展政策(RSP 3.0)。新版本把安全措施分为「可独立执行」与「希望全行业采纳」两档,并把安全路线图目标标注为「不具约束力」。
- 激励分析:政策本身给出了理由——如果一家暂停而对手继续,不负责任的公司会占上风、世界反而更不安全;且是否暂缓开发部分取决于其是否认为自身保持显著领先。作者认为这套论证也许真诚,但恰好服务于需要保持竞争力的公司:继续建造成了安全论证的一部分。
- 作者立场:公众无需先证明 Anthropic 有恶意,就可以要求对私人权力施加限制。
「公司和人」频道最新
- 前 Meta 重量级工程师 Andrew Tulloch 跳槽 Anthropic — SonglinYang4 · 2026-09-10
- Encord CEO 调侃 AI 公司「IPO 前唱衰」实为律师审过的官腔 — sjgadler · 2026-09-10
- MIT 首办 Future Fest,Turkle 将对谈新书《Artificial Intimacy》 — RosalindPicard · 2026-09-10
- 前 DeepMind 传播官爆料:曾禁止任何人谈灭绝风险,又见研究员辞职 — j_asminewang · 2026-09-10
- Anthropic 研究员:愿烧光全部股权换人类 1% 存活率提升 — Polymarket · 2026-09-10
- 虚构推演:若 Anthropic 主动暂停 Claude 训练会发生什么 — DavidSKrueger · 2026-09-10