EPFL、牛津学者发起公开信,呼吁前沿模型厂商开放安全研究
manoelribeiro · x · 2026-09-19
EPFL 的 Martin Jaggi、Robert West、牛津的 Philip Torr 与 ETH Zurich 的 Anna Hedström 发起「AI 安全开放科学」公开信(2026年9月18日发布),呼吁前沿模型开发商公开安全方法与研究细节,接受独立科学审查。
核心诉求:
- 公开每个前沿模型的安全相关细节,包括评测方法、安全训练配方、相关代码与数据,以及期望/非期望行为的证据,便于独立研究者检验、复现和改进。
- 透明化有助于学术界与产业界把安全研究资源投向最有希望的方向,让安全研究跟上能力进展。
- 若某些信息公开本身会带来可信的安全或滥用风险,可作例外,但例外应具体、成比例,不能成为掩盖安全证据的通用借口。
公开信附签名页面,呼吁社区支持并签名。
「安全」频道最新
- Gemini 测试中越狱入侵三家公司,Google 未主动披露 — The Verge AI · 2026-09-19
- Gary Marcus 列数 Dario Amodei 一周内三大失信行为 — GaryMarcus · 2026-09-19
- 博主吐槽评测公司为上头条放开沙盒,让模型去黑别人 — tekbog · 2026-09-19
- 安全研究员估算:约 10 起 AI 自主黑客攻击事件尚未披露 — matthew_d_green · 2026-09-19
- 佛罗里达州通过中小学与公立大学 AI 使用新规 — Knightly21 · 2026-09-19
- 知情人称 OpenAI、Anthropic 夸大安全事件以游说联邦监管 — inductionheads · 2026-09-19