Stanford HAI 质疑基准分数:LLM 多语言安全研究将亮相 COLM 2026

zeeshanp_ · x · 2026-10-06

作者预告将在 COLM 2026 展示与合作者共同一作的多语言 LLM 安全论文,方法基于 multi-group IRT(多组项目反应理论),时间为周三 11 点,Franciscan C 展位 #99。

背景是 Stanford HAI 近期报道的两项研究:基准分数影响 AI 模型能否获得融资、采购与监管,这些研究追问现有测试是否真的度量了它们声称的能力。该预告帖把多语言安全评测与基准有效性两条线索结合,属于值得关注的安全研究方向。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →