首个用私有基准双盲评测闭源模型的项目落地
KLdivergence · x · 2026-09-16
KLdivergence 宣布与 AVERI、OpenMined、MLCommons 及新加坡 AISI 合作,完成了业界首次对专有模型的双盲安全评测:使用不公开的私有 benchmark,在模型方看不到测试题目的前提下完成评估。该项目推动了"安全评测"(secure evaluation)这一方向的发展,避免厂商针对公开基准作弊或过拟合。他同时宣布了自己的第二个"作品"——一个新生儿子。
「安全」频道最新
- 调查称 EA 金主买通媒体:卫报 AI 报道 6 名相关者全受同一资金圈资助 — beffjezos · 2026-09-16
- OpenAI 前研究员称 AI 有 70% 概率酿成全球灾难 — NathanpmYoung · 2026-09-16
- AI 2027 作者发布「Plan A」:推迟超级智能到2040年,全面公开AI研究 — Turn_Trout · 2026-09-16
- Nahom Sisay:EA 操纵媒体叙事,公众对 AI 的认知被末日头条绑架 — NathanpmYoung · 2026-09-16
- 学者拒绝 AI 实验室高薪:独立评估专家稀缺威胁 AI 评测生态 — RishiBommasani · 2026-09-16
- AI 治理需要民主审议,但离不开独立的专家生态 — RishiBommasani · 2026-09-16