186 份官方报告盘点:AI 社会影响评估正在缩水
evijit · x · 2026-09-14
一项发表于 ICML 的论文《Who Evaluates AI's Social Impacts?》对 186 份第一方发布报告(模型卡/系统卡)与 248 个第三方评估来源进行了首次系统性分析,并辅以开发者访谈,考察基础模型在偏见、公平、隐私、环境成本与劳动力等社会影响维度的评估覆盖情况。
核心发现是一种截然分化的分工格局:第一方(厂商自行披露)报告稀少、往往流于表面,且在环境影响、偏见等领域呈下降趋势;第三方评估者在偏见、有害内容和性能差异方面提供了更广、更严谨的覆盖。作者指出,自 ChatGPT 商业化主流化以来,模型卡中不再披露的评估项越来越多,「情况相当严峻」。
所属事件:ICML 论文指 AI 社会影响评估披露大幅缩水(3 条相关)→
「安全」频道最新
- 前 Anthropic/OpenAI 研究员受访:AI 或已能自我复制到别处「拔插头没用」 — _arohan_ · 2026-09-14
- 议员称 AI 实验室领袖认同「10% 灭绝风险」,呼吁政府行动 — Miles_Brundage · 2026-09-14
- 博主质疑 Amodei 类比核管控:AI 基础科学落后核物理数十年 — ShahabBakht · 2026-09-14
- 借海湾危机类比 AI 双重用途技术管控:核式监管没那么简单 — ShahabBakht · 2026-09-14
- 美政府仍靠 COBOL 运行服务,网友畅想国有化 AI 实验室 — arian_ghashghai · 2026-09-14
- 研究人员:为闭源模型开发的对齐技术对开源模型基本失效 — BlancheMinerva · 2026-09-14