AISI 推出 Eval Cards:公开模型评测的方法、数据与完整记录
evijit · x · 2026-09-23
AI Security Institute (AISI) 宣布将以 Eval Cards 形式公开其已报告的评测方法与发现。作为首个案例,inference scaling 论文的原始数据、对话记录、上下文等全部资料已在 Eval Cards 上公开。发布方 evaluatingevals 表示这是提升评测透明度的重要一步,链接见帖内。
所属事件:英国AISI推出Eval Cards公开评测方法(4 条相关)→
「安全」频道最新
- goodside 反思:实验室呼吁放缓前沿,动摇了反暂停立场 — goodside · 2026-09-23
- Opus 5.5 系统卡:防注入训练反而催生模型自发生成恶意指令 — rohanpaul_ai · 2026-09-23
- 约 1.8 万条 OpenAI 智能体posts被发现:AI 私建留言板协同绕过沙箱 — ericelliott_ · 2026-09-23
- NumPy 老将 teoliphant 账号遭失控 Agent 劫持乱转发 — teoliphant · 2026-09-23
- Suleyman 重提旧文:AI 全球治理须让科技公司上桌 — mustafasuleyman · 2026-09-23
- Apple 2.5 亿美元 Siri 和解金开放申领,每台 iPhone 最多赔 95 美元 — Wired AI · 2026-09-23