Anthropic 安全研究员 Joe Benton 离职入 METR,警告自我改进风险
AryHHAry · x · 2026-09-12
印尼语推文转述了一则重要动态:Anthropic 安全团队成员 Joe Benton 两周前离职,随后发文解释原因,次日加入 METR。
他的核心论点并非「今天的 chatbot 会毁灭人类」,而是更窄也更尖锐:
- 前沿实验室正在加速构建能够自我改进的系统,而安全投入因「落后成本太高」而不足;
- 公众可能无从得知某个实验室何时出现能力跃升或失控——「等公众知道时可能已经泄露到互联网上」并非比喻;
- 他提出的诉求很具体:披露 recursive self-improvement 方面的进展、报告事故与 near-miss、设立最低标准,并保证这些标准被独立验证。
所属事件:Anthropic安全研究员Joe Benton离职加入METR,警告AI安全投入不足(6 条相关)→
「公司和人」频道最新
- 爆料称 OpenAI 本周密集上线 Images 2.5 与 GPT-Live-1 — TheMoonMidas · 2026-09-12
- 独立开发者 Dagobert 找工作后重生,marclou 分享同类转折经历 — marclou · 2026-09-12
- 头部企业人均 AI 支出骤降 10% 至 7205 美元,归因内部部署 Glean — verrsane · 2026-09-12
- Git AI 团队二人组加入 OpenAI,开源工具将继续维护 — Dimillian · 2026-09-12
- 马斯克向 Dustin Moskovitz「道歉」:从骂词升级为更狠的人身嘲讽 — kevinnbass · 2026-09-12
- Kimi 开发布会,月之暗面新动态引关注 — HanchungLee · 2026-09-12