Anthropic暂缓部分前沿训练,主张以安全信心定节奏
Anthropic宣布暂时放缓部分前沿模型训练以强化安全监控与防护,最大规模的前沿RL训练目前仍处于暂停状态,公司正通过较小规模训练与评估来测试安全护栏、收集对齐证据。研究者Merrett主张以“节奏”而非“暂停”推动AI发展,即依据安全信心调整开发速度,并为此签署了《Pacing the Frontier》倡议,同时追问无安全团队的SpaceX类AI风险。
2026-08-19 ~ 2026-08-19 · 3 条相关
- Anthropic 暂缓部分前沿训练以强化安全措施 — merettm · 2026-08-19
- Anthropic暂缓前沿RL训练,安全研究者追问无安全团队的SpaceXAI风险 — Miles_Brundage · 2026-08-19
- Merrett 呼吁 AI 发展应以安全为节奏 — repligate · 2026-08-19