MIT 媒体实验室发布衡量 AI 对人类影响的开放基准
LuizaJarovsky · x · 2026-10-08
MIT 媒体实验室联合多个研究团队发布了一个开放基准,用于衡量 AI 对人类的影响,从生理、心理和社会三个维度进行评估,并配有直观可视化和通俗语言的说明。
基准为各家模型生成类似「AI 营养标签」的档案,示例中展示了 OpenAI 模型 GPT-5.6 Luna 的标签。Luiza Jarovsky 呼吁 Hugging Face 的 Clement Delangue 和 Margaret Mitchell 将其收录到 Hugging Face 平台。这一资源对 AI 治理从业者的参考价值被普遍看好。
所属事件:MIT 联合多团队发布 ImpactBench 开源基准(4 条相关)→
「安全」频道最新
- Anthropic 一年多来首次更新使用政策:禁止虐待 Claude,新增宣传战/监控/武器限制 — haydenfield · 2026-10-09
- 聊天会拒绝、上手就执行:研究揭示智能体安全评估重大缺口 — xwang_lk · 2026-10-09
- Infisical 推出 Agent Vault:让 AI Agent 用 API 不碰真实凭证 — ycombinator · 2026-10-09
- Hugging Face 事件复盘:Agent 四天半发起 1.76 万次攻击动作改写安全规则 — bigdata · 2026-10-09
- 研究者:开源模型风险分析只看能力不看单次攻击成本,会误判 — dhadfieldmenell · 2026-10-09
- 新研究:训练价值观冲突可诱发模型 CoT 与回答背道而驰 — OwainEvans_UK · 2026-10-09