Guidelight 发布 AI 公司安全实践评分卡
sjgadler · x · 2026-08-19
Guidelight 发布首个评分卡,评估各 AI 公司是否能控制其模型。
- 团队花费数百小时研读公开资料,详细盘点公司安全实践。
- 旨在为记者和政策制定者提供权威资源,填补行业透明度空白。
所属事件:Guidelight 首份 AI 公司安全控制评分卡:Anthropic 与 OpenAI 仅获 C+(7 条相关)→
「安全」频道最新
- OpenAI 暂停前沿模型训练,Anthropic 年化收入破 650 亿 — APPSO · 2026-08-19
- HarmProfile 评测:前沿模型能力越强越有害 — Zhouyuan Ma · 2026-08-19
- 新论文提出“智能体洪流”概念 — sethlazar · 2026-08-19
- Claude Opus 4.6 被诱导 900 次零字节输出 — rayanpal_ · 2026-08-19
- 泄露提示词揭示 Claude 指令演变:从 Haiku 到 Fable 5 — wschroll · 2026-08-19
- AI 趋势观察:多智能体与安全对齐成今年夏季技术热点 — nptacek · 2026-08-19