研究称顶尖 AI 实验室缺乏失控模型遏制计划

Guidelight AI Standards 研究显示,包括 OpenAI、Anthropic、Google、Meta 和 xAI 在内的五大顶尖 AI 实验室大多未公开应对"叛变"或失控模型的详细遏制计划。前 OpenAI 安全研究员、现任 Guidelight 首席科学家 Sam Adler 引用 Hugging Face 数据泄露等事件,质疑前沿实验室的应对准备不足。

2026-08-23 ~ 2026-08-24 · 3 条相关