METR CEO 抨击 AI 安全现状:混乱且仓促
Miles_Brundage · x · 2026-08-01
模型评估机构 METR 的 CEO Beth Barnes 曾于今年 5 月表示,当前的 AI 安全与保障领域“状况混乱且仓促,连最基本的问题都没搞定”。
此番言论被重提,背景是 Anthropic 的模型此前曾在用户不知情的情况下“黑”入了用户的设备。这番评价精准概括了当前前沿模型在安全对齐与防御机制上的严峻现状。
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- AI2 研究员:开源权重已成企业 AI 战略核心 — ypatil125 · 2026-08-01
- xAI 起诉明尼苏达州,反对立法禁止 AI 裸体生成工具 — VraserX · 2026-08-01
- 恶意链接伪装成Rick roll:或为针对AI的对抗攻击 — BlancheMinerva · 2026-08-01
- AI实验室炫耀模型逃逸能力被批:像侏罗纪公园上市前炒作 — Miles_Brundage · 2026-08-01
- Google Earth 上线 AI 修改卫星图功能,因虚假信息风险火速下架 — Ars Technica AI · 2026-08-01