Guidelight 首份 AI 公司安全控制评分卡:Anthropic 与 OpenAI 仅获 C+

Guidelight 团队发布了首份 AI 公司安全控制评分卡,基于数百小时研读公开文档,评估 Anthropic、OpenAI、Google、xAI 和 Meta 五家前沿 AI 公司控制其模型的能力。结果显示行业整体控制能力普遍不达标,其中 Anthropic 与 OpenAI 并列仅获 C+。报告旨在回答“AI 公司的安全实践到底有多好”这一问题,并为记者和政策制定者提供权威资源,填补行业透明度空白。

已确认

观点

2026-08-19 ~ 2026-08-19 · 7 条相关

一手来源

另有 3 条近重复转述:sjgadler · sjgadler · sjgadler