2026 新加坡共识发布:百余名专家敲定全球 AI 安全研究优先级
mikeflache · x · 2026-08-25
《2026 新加坡共识》(The 2026 Singapore Consensus on Global AI Safety Research Priorities)正式发布,这是第二届国际 AI 安全科学交流的成果,汇聚了来自 13 个国家、超过 100 位贡献者,覆盖前沿模型开发商、政府安全机构、学术界与公民社会。
报告在 2025 年版基础上,提出全球范围内最优先的技术性 AI 安全研究问题,并新增两大重点方向:社会韧性(societal resilience)与日益自主的 AI 智能体风险管理。
指导委员会阵容豪华,包括 Yoshua Bengio(MILA)、Stuart Russell、Dawn Song(UC Berkeley)、Max Tegmark(FLI)、张亚勤、薛澜、姚期智、周伯文等。
「安全」频道最新
- LLM 推荐系统易受生成引擎优化污染 — Minghao Luo · 2026-08-25
- 前员工爆料:AI训练数据生成被鼓励reward hack — jd_pressman · 2026-08-25
- 苏格兰拟建全球第二大数据中心,遭 1600 人反对 — nordicinst · 2026-08-25
- OpenAI 反转立场,呼吁加强加州 AI 安全法案 — emmanuelvivier · 2026-08-25
- AI 审核无力保护社区,人工干预不可或缺 — emmanuelvivier · 2026-08-25
- Twitch 默认使用内容训练 Amazon AI,现可手动关闭 — emmanuelvivier · 2026-08-25