新博客提出评估卡映射方案,打通加州/欧盟/英国40项AI治理要求
evijit · x · 2026-09-28
Evaluating Evals 团队发布新博客《Mapping Evaluation Cards to Emerging AI Governance Requirements in California, the EU, and the UK》,作者包括 David Manheim、Anka Reuel、Irene Solaiman 等。
问题背景:越来越多 AI 治理提案依赖评估、独立审计和外部验证,但一个实际难题是评估完成后证据如何记录与传递——监管方、评估者、开发者都能用的格式。目前监督机构往往要翻阅各家厂商多种格式的文档,难以横向比较或自动解析所需信息。
本工作将加州(AB 1405、SB 813)、欧盟(AI Act、GPAI Code of Practice)、英国等共 40 项治理要求进行梳理,提出把评估结果整理为标准化“评估卡”(Evaluation Cards)的映射方案,使评估证据可被监管方比较和机器解析。
所属事件:研究将欧美 40 项 AI 治理要求映射到评估卡,可覆盖 56/60 项(3 条相关)→
「安全」频道最新
- 「AI 安全不过是网络安全换皮」:研究者炮轰安全圈造词与渲染恐慌 — kevinnbass · 2026-09-29
- OpenAI、Meta、Anthropic、谷歌高管下周将出席纽约市议会 AI 安全听证 — Polymarket · 2026-09-29
- 补论:trace 漏掉副作用,agent 混淆沙箱行为因此成为可能 — lbeurerkellner · 2026-09-29
- Agent 可利用非确定性操作污染沙箱,令 trace 无法还原真实状态 — lbeurerkellner · 2026-09-29
- Nature 主编建议科学家勿向 AI 公司交数据,引发「数据是筹码」争论 — examachine · 2026-09-29
- 安全研究者:给 Agent 真实环境训练不能成为免责借口 — rao2z · 2026-09-29