Anthropic暂缓部分前沿训练,主张以安全信心定节奏

Anthropic宣布暂时放缓部分前沿模型训练以强化安全监控与防护,最大规模的前沿RL训练目前仍处于暂停状态,公司正通过较小规模训练与评估来测试安全护栏、收集对齐证据。研究者Merrett主张以“节奏”而非“暂停”推动AI发展,即依据安全信心调整开发速度,并为此签署了《Pacing the Frontier》倡议,同时追问无安全团队的SpaceX类AI风险。

2026-08-19 ~ 2026-08-19 · 3 条相关