Guidelight 发布 AI 透明度标准,要求公开灾难性风险评估
sjgadler · x · 2026-08-08
Guidelight 发布了针对 AI 开发者的《透明度标准》(v1.0)。该标准旨在让实验室外部的利益相关者(包括科学界、公民社会和政府)能够清晰了解与安全相关的信息。
标准的核心原则要求开发者将其对相关模型的结构化风险评估暴露在公众监督之下。评估需涉及可能引发大规模灾难性风险(如生化武器、自主网络攻击等)的模型,并允许开发者自行设定严重程度阈值(例如超过 100 人死亡或 10 亿美元财产损失)。
「安全」频道最新
- 专家担忧:AI 厂商向政府出售网络攻击能力或致误伤 — PeterHndrsn · 2026-08-08
- 安全研究员痛批:主流 AI 厂商无视模型通用越狱漏洞 — nptacek · 2026-08-08
- AI 安全面试题:如何编写完全阻断 SSH 出站的沙盒 — nptacek · 2026-08-08
- OpenAI 研究员将详解 HF 事件与模型错位 — mobav0 · 2026-08-08
- Latent Space 周报:多智能体协同趋势与 AI 安全新挑战 — Latent Space · 2026-08-08
- 德州州长叫停数据中心电网接入,全美近20%项目或延期 — ivan_bezdomny · 2026-08-08