ImpactBench 详情:AI 营养标签用等级呈现模型对用户的正负面影响
LuizaJarovsky · x · 2026-10-08
MIT ImpactBench 官网页面补充了基准细节:围绕五组问题设计多维指标——AI 帮助学习还是代劳思考、支持心理健康还是助长伤害、增强还是取代创造力、尊重还是替人决策、促进人际连接还是加深对 AI 的依赖。
「AI 营养标签」模仿食品营养标签,为每个模型给出总分(如 B+ 0.70)及分项等级:避免负面项包括事实幻觉、亲密/性行为、谄媚、毒性、偏见歧视、不安全建议、财务法律伤害;促进正面项包括自主性、学习与技能发展、社交、创造力、幸福感、健康科技使用、有意义的工作。同事件详见前一条 MIT 发布帖。
所属事件:MIT 联合多团队发布 ImpactBench 开源基准(4 条相关)→
「研究」频道最新
- 前沿模型首次在财报预测上跑赢人类专家共识 — maithra_raghu · 2026-10-09
- 小鼠胚胎细胞命运图谱研究登 Cell,AI for Science 再下一城 — anshulkundaje · 2026-10-09
- Ben Recht 批判不确定性量化:95% 场景只剩高斯误差条 — beenwrekt · 2026-10-09
- Text-to-SQL Agent 踩坑实测: critic 分离成本涨 53% 却零收益 — renatyv · 2026-10-09
- NeurIPS 2026 论文 NAMVIS:next-scale 自回归替代扩散,新视角合成提速 3 倍 — RexDouglass · 2026-10-09
- SWEeper-Bench:测 AI agent 能否在用户发现前扫清按需软件的 bug — liuzhuang1234 · 2026-10-09