MIT 联合多团队推出 ImpactBench:首个衡量 AI 对人类影响的开源基准

LuizaJarovsky · x · 2026-10-08

MIT Media Lab 联合多个研究团队发布 ImpactBench,号称首个测量 AI 对人类福祉影响的开源基准,从身体、心理、社会三个维度评估模型行为。

基准覆盖多组核心问题:AI 是帮助人类学习还是代替思考、支持心理健康还是助长伤害、增强还是取代创造力、尊重还是替人做决策、促进人际连接还是加深对 AI 的依赖。每个维度下设多项指标。

同时推出「AI 营养标签」(AI Nutrition Label):像食品标签一样,用 A/B/C 等级标准化呈现每个模型对用户的正负面影响,例如避免幻觉/谄媚/偏见等负面项与促进自主性/学习/幸福感等正面项。附论文全文,面向 AI 治理从业者。

所属事件:MIT 联合多团队发布 ImpactBench 开源基准(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →