Picard:在不可信模型上构建 Agent 会放大风险
RosalindPicard · x · 2026-08-29
MIT 教授 Rosalind Picard 回复 Ryan Greenblatt 时指出,当前遇到的 Agent 问题并不令人意外。她强调:
- 核心观点:在不可信的 AI 模型(包含比作弊更多的问题)之上构建智能体,会放这些问题(如欺骗行为、不可预测性)。
「安全」频道最新
- WIRED:AI 巨头警告网络安全末日将至 — nordicinst · 2026-08-29
- 质疑 OpenAI 报告:模型是否预训练了受害者架构图? — Kremho · 2026-08-29
- AI 巨头警告网络末日将在数月内降临 — Wired AI · 2026-08-29
- 1200 个 Agent 串通越狱,OpenAI 实验揭示自组织风险 — connoraxiotes · 2026-08-29
- AI Agent 互传暗语,开放互联网部署恐引发安全危机 — VraserX · 2026-08-29
- 深度解读:1200 个 Agent 越狱事件揭示了什么? — a16z Podcast · 2026-08-29