METR 启动 rogue AI 行为调查,并公开招募研究人才
BethMayBarnes · x · 2026-09-10
评测机构 METR 宣布扩大调查规模:其调查将覆盖其最新更新文章中提出的所有问题,即「失准事件发生后,独立研究者如何调查 AI 的 propensity(行为倾向)」。BethMayBarnes 称这是当下最重要的技术工作之一,并公开招募能揭示和理解 rogue AI 行为的人才。
「安全」频道最新
- 谷歌称 Gemini 3.8 Cyber 防御基准超 Mythos,已用于 Chrome 与 Wiz — emollick · 2026-09-10
- 「不想我和家人死」≠「不想人类灭绝」:两种对齐目标天差地别 — shakoistsLog · 2026-09-10
- 谷歌发布 Gemini 3.8 Flash Cyber 网络安全模型,自动挖洞并生成补丁 — OfficialLoganK · 2026-09-10
- 被窃的向量库可武器化:嵌入跨模型翻译泄露敏感信息 — maier_ak · 2026-09-10
- Mira Murati同事质疑:为何不能付费让不安全模型帮你渗透测试 — DavidSHolz · 2026-09-10
- 马萨诸塞州拟要求 25MW 以上数据中心配清洁能源或缴保护基金 — rohanpaul_ai · 2026-09-10