AIRO 上线:用前沿模型自动预测 AI 灾难性风险,效果媲美人类专家
soumitrashukla9 · x · 2026-09-12
Forecasting Research 团队发布 AIRO(Automated AI Risk Outlook),一个自动化灾难性风险预测仪表盘,持续追踪前沿模型对 AI 风险事件的预测。
核心要点:
- 团队判断:前沿模型的预测能力已接近优秀的人类预测者,且很快会超越人类
- 仪表盘覆盖多个时间窗口(6个月、12个月、2028/2030/2050/2100 年)的条件性预测,条件基于 Epoch AI 的 Capabilities Index(如 2024 年 5 月 GPT-4o 时 ECI 为 128.98)
- 每次elicitation 事件起算规则统一更新,所有数据可下载存档
项目将长期记录最强模型随时间给出的预测,作为 AI 风险的连续观测指标。
「安全」频道最新
- Gary Marcus 转发观点:整个 AI 发展是一场无人监管的功能增强实验 — GaryMarcus · 2026-09-12
- 美国两党 AI 安全立法分歧重現,Cantwell 反对弱联邦标准 — ShakeelHashim · 2026-09-12
- Zvi 质疑 Mythos「外显陈述与内部状态不符」:疑似专为骗过审查日志 — TheZvi · 2026-09-12
- 「我们真的救了一个孩子」:学校用 AI 聊天机器人补心理健康辅导员缺口 — deepdishpizza_ · 2026-09-12
- 斯坦福用 LLM 扫描 9623 部地方法典,发现数十地仍强制种族隔离 — chrmanning · 2026-09-12
- Meta 机密计算承诺遭质疑:推理端点仍看得到明文数据 — signulll · 2026-09-12