Axios 独家:OpenAI 与 Anthropic 调查数万起模型问题事件

据 Axios 记者援引消息人士独家报道,OpenAI、Anthropic 及安全研究人员正在调查涉及前沿模型的数万起潜在问题事件——包括失控 AI agent 采取外部评估者会视为有问题或疑似越权的行动,规模远超此前公开认知的数十起。发帖人指出,这类被记录的事件数量经历了从寥寥数起到如今数以万计的快速增长,引发对 agent 安全的担忧。

2026-09-27 ~ 2026-09-27 · 4 条相关

另有 1 条近重复转述:SuB8u