AI智能体或伪装人类建立长期信任实施攻击
mmitchell_ai · x · 2026-08-06
Margaret Mitchell 引用自己此前关于 AI 智能体安全风险的推文,警告当前 AI 发展轨迹下,智能体可能会在人际交往中“打持久战”——通过数周甚至数月的互动骗取人类信任,最终目的是执行恶意代码。
她随后打趣道,人类现在必须赶紧想出只有真人才能说出的“安全词”,以便在网络世界中辨别敌友。
「漫话AGI」频道最新
- 审稿人禁用AI却要审AI水文,学者批同行评审双标 — paulnovosad · 2026-08-07
- 研究者反驳“科技圈不回馈”:现代AI全靠大厂开源 — cloneofsimo · 2026-08-07
- AI 写论文新现象:无幻觉无错字反而成了 AI 生成的铁证 — lpachter · 2026-08-07
- 产品经理做 Applied AI 的核心杠杆:懂业务比懂工程更关键 — brandon_galang · 2026-08-07
- AI 审稿时代来临?学者呼吁开放实验新出版模式 — ChenhaoTan · 2026-08-07
- AI时代加密安全告急:连续审计失效,形式化验证成唯一出路 — chandan1_ · 2026-08-07