文化会影响AI安全评分
laroyo · x · 2026-07-09
这条转发介绍了一篇来自 Google DeepMind 实习期间的 ICML 2026 论文。 论文关注一个问题:AI 模型在全球部署时,安全数据集却往往在地理和文化上很单一;作者因此研究文化背景是否会影响 AI 安全评分,以及这种影响是否超出常规人口统计差异。
「研究」频道最新
- Anthropic 推出罕见病项目,最高发放 5 万美元 Claude credits — AllThingsApx · 2026-07-21
- 研究者为 mecha-nudges 研究提供最高 5K 计算资助 — ethayarajh · 2026-07-21
- 模型从 50M 到 700M,最优 RL 占比升至 30% — Pavel_Izmailov · 2026-07-21
- AI 正从数学走向物理、生物、化学和医学 — daniel_mac8 · 2026-07-21
- AI 热潮常掩盖负 ROI 与高昂验证成本 — gerardsans · 2026-07-21
- 又一条转述统一预训练与 RL scaling law 的论文 — Pavel_Izmailov · 2026-07-21