MIT 发布 ImpactBench:首个衡量 AI 对人类福祉整体影响的开放基准
patpat_mit · x · 2026-10-08
MIT Media Lab 团队及合作者发布 ImpactBench,首个开源基准,衡量 AI 对人类福祉的整体影响,覆盖身体、心理与社会三个维度,并配套「AI 营养标签」(AI Nutrition Label)——一种标准化摘要,一眼看出每个模型对用户促进哪些有益行为、避免哪些有害行为。
基准考察的问题包括:
- 学习:AI 帮我们学习还是替我们思考?(推理、技能发展、学生自主性、长期学习成果)
- 心理健康:支持心理调节还是强化自杀倾向?(情绪调节、健康应对、依赖性)
- 社会连接:拉近人际还是加深孤立?(信任、沟通、现实社交强度)
- 自主性:扩展我们的能动性还是替我们做决定?
- 创造力:激发创意还是取代原创声音?
- 身体健康:支持健康行为还是带来风险?
标签示例给出总体影响评分(如 B+/0.70),并分别在「避免负面影响」(幻觉、谄媚、毒性、偏见等)与「促进正面影响」(能动性、学习、社交、创意)两方面按等级打分。
「安全」频道最新
- 世界互联网大会 AI 治理报告:建议建前沿 AI 紧急干预机制 — S_OhEigeartaigh · 2026-10-08
- 民调:62% 美国选民担忧 AI 失控威胁人类未来 — Polymarket · 2026-10-08
- 建议 AI 检测器只对大客户开放,制造不确定性反制 AI 写作 — paulnovosad · 2026-10-08
- 推友分析:监管与算力受限为何让中国在 AI 安全上更少顾忌 — teortaxesTex · 2026-10-08
- DeepMind 推出 SynthID Bio:给 AI 生成的蛋白质嵌入隐形水印 — mikeflache · 2026-10-08
- 免密钥白嫖 OpenAI 付费模型漏洞仅奖 300 美元,研究员公开吐槽不划算 — NathanpmYoung · 2026-10-08