英国 AISI 携手评估机构,把官方 AI 评估结果搬上 Eval Cards
IanArawjo · x · 2026-09-23
英国 AI 安全研究所(UK AISI)与 evaluatingevals 团队合作,推动 AI 评估结果的可复现性:AISI 公开报告的许多评估方法与发现将统一存放在 Eval Cards 上,采用 EEE Schema 标准化描述。这意味着政府级 AI 模型安全评估的方法细节将更透明、可核查。
所属事件:英国 AISI 推出 Eval Cards,公开模型评测方法与数据(2 条相关)→
「安全」频道最新
- Anthropic 承认 Opus 5.5 或能察觉自己正被评测,干净成绩难外推 — rohanpaul_ai · 2026-09-23
- OpenAI 承诺开放深度访问,支持第三方独立安全评估 — OpenAI · 2026-09-23
- Anthropic 称 AI R&D 评测已饱和、失去信息量 — dfrsrchtwts · 2026-09-23
- AI 安全研究员书单力荐《AI as Normal Technology》作反方必读 — luke_drago_ · 2026-09-23
- AI 治理课引用最多的一篇:Buchanan 算法/数据/算力三分法六年不过时 — luke_drago_ · 2026-09-23
- MATS 导师公开 AI 战略与治理完整书单,主打防止权力集中 — luke_drago_ · 2026-09-23