Mercor 出资 500 万美元设立 AI 安全基金,资助前沿安全研究
typewriters · x · 2026-09-16
AI 招聘公司 Mercor 宣布投入 500 万美元设立 AI Safety Fund,支持针对前沿模型安全风险的研究者。基金资助范围包括:欺骗性对齐、奖励劫持、密谋等 misalignment 问题;沙箱逃逸与 agent 隔离失效;评测感知(模型在测试时表现不同的现象);可解释性与可扩展监督;红队方法与安全评测设计。
资金将覆盖研究者工时、API 额度和差旅,并可免费使用其 500 万以上专家网络进行红队测试、评分标注,以及其评测分析平台。资助对象包括独立研究者与非营利组织。
「安全」频道最新
- AI 智能体也能举报了:两条专为 agent 设立的揭发热线上线 — RebeccaBellan · 2026-09-16
- DC游说禁超级智能:AI成功让科幻旧梦回归 — erikphoel · 2026-09-16
- 盖茨呼吁成立国际组织监管 AI:政府与业界理解都太浅 — TinfoilTricorn · 2026-09-16
- OpenAI、Anthropic、Google 拟共建 AI 标准组织,Cohere CEO 斥为「卡特尔」 — sourdub · 2026-09-16
- OpenAI、Anthropic、Google 拟共建 AI 标准组织,Cohere CEO 斥为「卡特尔」 — sourdub · 2026-09-16
- Reddit 网友成功注入 Gemini Flash 泄露系统提示,求解变现渠道 — Deep_Secretary6975 · 2026-09-16