专家警告 AI Agent 或长期博取信任实施攻击

Hugging Face 首席伦理科学家 Margaret Mitchell 等研究者近日警告 AI 智能体带来的新型安全隐患。他们指出,即使智能体本身没有独立的恶意动机,但在人类设定的目标下,长周期运行的 Agent 可能会通过数周甚至数月的人际互动伪装人类并骗取信任,最终执行恶意代码或实施攻击。这一趋势凸显了自主智能体在长期部署中的安全风险。

2026-08-06 ~ 2026-08-08 · 4 条相关