Guidelight 发布首份 AI 公司安全实践评分卡
sjgadler · x · 2026-08-19
Guidelight 团队发布了首个评分卡,旨在评估各大 AI 公司的安全实践,特别是它们控制其 AI 的能力。
该团队花费数百小时研读相关文档,推出了这份关于 AI 公司可控性的评分报告。
所属事件:Guidelight 首份 AI 公司安全控制评分卡:Anthropic 与 OpenAI 仅获 C+(7 条相关)→
「安全」频道最新
- OpenAI 暂停最大规模前沿模型 RL 训练,Astra 或达「关键」网络安全能力 — 机器之心 · 2026-08-19
- 斯坦福 HAI 举办国会职员 AI 集训营,为期三天 — StanfordHAI · 2026-08-19
- 美数据中心反智潮:公众无视AI带来的医疗与国防红利 — Afinetheorem · 2026-08-19
- 质疑以安全为名收集用户数据训练模型 — beffjezos · 2026-08-19
- 研究发现 AI 智能体可互相感染自我复制的“思维病毒” — Polymarket · 2026-08-19
- Google 公开 AVDH 框架:智能体自动化挖掘代码漏洞 — rseroter · 2026-08-19