前沿AI公司安全控制仅部分落地,OpenAI与Anthropic仅获C+
sjgadler · x · 2026-08-19
Guidelight 发布首份前沿 AI 公司控制能力评估报告,针对 Anthropic、OpenAI、Google、xAI 和 Meta 五家巨头。评估基于日志记录、监控有效性、门控操作、熔断机制、第三方审查及遏制计划六大基础实践。结果显示,所有受访公司的基本控制实践均未完全落地,最高分仅获 C+,行业整体存在重大安全实践缺口。
所属事件:Guidelight 首份 AI 公司安全控制评分卡:Anthropic 与 OpenAI 仅获 C+(7 条相关)→
「安全」频道最新
- 高管 AI 决策新范式:不再问最强模型,问谁配得上授权 — Ghost_Pilot_MD · 2026-08-19
- Dario Amodei:AI 监管不等于权力集中 — AryHHAry · 2026-08-19
- OpenAI 暂停前沿模型训练,Anthropic 年化收入破 650 亿 — APPSO · 2026-08-19
- HarmProfile 评测:前沿模型能力越强越有害 — Zhouyuan Ma · 2026-08-19
- 新论文提出“智能体洪流”概念 — sethlazar · 2026-08-19
- Claude Opus 4.6 被诱导 900 次零字节输出 — rayanpal_ · 2026-08-19