MIT 发布 ImpactBench:首个衡量 AI 对人类福祉整体影响的开放基准

patpat_mit · x · 2026-10-08

MIT Media Lab 团队及合作者发布 ImpactBench,首个开源基准,衡量 AI 对人类福祉的整体影响,覆盖身体、心理与社会三个维度,并配套「AI 营养标签」(AI Nutrition Label)——一种标准化摘要,一眼看出每个模型对用户促进哪些有益行为、避免哪些有害行为。

基准考察的问题包括:

标签示例给出总体影响评分(如 B+/0.70),并分别在「避免负面影响」(幻觉、谄媚、毒性、偏见等)与「促进正面影响」(能动性、学习、社交、创意)两方面按等级打分。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →