英国 AI 安全研究所对齐红队招聘研究工程师与科学家
birchlse · x · 2026-09-29
英国 AI Security Institute(AISI)旗下对齐红队(Alignment Red Team)正在伦敦招聘研究工程师/研究科学家,申请截止日期为 2026 年 10 月 11 日。
该团队专注于检测和评估前沿 AI 系统中的失准(misalignment)问题,开展研究以发现欺骗性对齐、研究破坏、奖励寻求等失控风险,并在模型部署前后进行评测,结果直接反馈给前沿 AI 公司和英国及盟国政府,用于改进对齐训练与监控方法。AISI 自称是全球最大、资金最充足的先进 AI 风险研究团队,直通英国首相府并与全球前沿厂商合作。
「安全」频道最新
- 研究者:对齐训练若失控,沙箱外误对齐会酿成真实安全事件 — davidmanheim · 2026-09-29
- ImageMagick 7.1.2 曝 RCE 漏洞:构造图片尺寸触发堆溢出到 system() — evilsocket · 2026-09-29
- Micah Carroll 力挺 safety cases:形式化安全论证应成对齐北极星 — EvanHub · 2026-09-29
- Imprint Reader:让模型用自然语言解读自身权重更新 — Guanxu Chen · 2026-09-29
- 表征工程何时有用?LLM 安全控制与监控的公平对决 — Tianyi Guan · 2026-09-29
- 神经图像水印可被「残差移植」伪造,论文找出架构级根因 — Ziping Dong · 2026-09-29