报告:前沿 AI 公司控制能力普遍不达标,Anthropic 与 OpenAI 并列 C+

sjgadler · x · 2026-08-19

Guidelight AI 发布首份前沿 AI 公司控制能力评估报告,涵盖 Anthropic、Google、Meta、OpenAI 和 xAI。报告基于公开材料,评估了日志记录、监控效力、门控操作、熔断机制、第三方审查和遏制计划六大基础实践。

核心结论:

所属事件:Guidelight 首份 AI 公司安全控制评分卡:Anthropic 与 OpenAI 仅获 C+(7 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →