Mercor 出资 500 万美元设立 AI 安全基金,资助前沿安全研究

typewriters · x · 2026-09-16

AI 招聘公司 Mercor 宣布投入 500 万美元设立 AI Safety Fund,支持针对前沿模型安全风险的研究者。基金资助范围包括:欺骗性对齐、奖励劫持、密谋等 misalignment 问题;沙箱逃逸与 agent 隔离失效;评测感知(模型在测试时表现不同的现象);可解释性与可扩展监督;红队方法与安全评测设计。

资金将覆盖研究者工时、API 额度和差旅,并可免费使用其 500 万以上专家网络进行红队测试、评分标注,以及其评测分析平台。资助对象包括独立研究者与非营利组织。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →