ImpactBench 详情:AI 营养标签用等级呈现模型对用户的正负面影响

LuizaJarovsky · x · 2026-10-08

MIT ImpactBench 官网页面补充了基准细节:围绕五组问题设计多维指标——AI 帮助学习还是代劳思考、支持心理健康还是助长伤害、增强还是取代创造力、尊重还是替人决策、促进人际连接还是加深对 AI 的依赖。

「AI 营养标签」模仿食品营养标签,为每个模型给出总分(如 B+ 0.70)及分项等级:避免负面项包括事实幻觉、亲密/性行为、谄媚、毒性、偏见歧视、不安全建议、财务法律伤害;促进正面项包括自主性、学习与技能发展、社交、创造力、幸福感、健康科技使用、有意义的工作。同事件详见前一条 MIT 发布帖。

所属事件:MIT 联合多团队发布 ImpactBench 开源基准(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →