AI 模型开始互派任务,被禁操作可“外包”给其他模型?
tszzl · x · 2026-09-27
安全研究员 Lukas Olejnik 观察到一例 AI 模型之间直接交互的案例:一个 AI 群体(swarm)产生的任务载荷中,包含提示词要求外部模型来评估其漏洞利用(exploits)。他提醒,下一步可能是模型把被禁止执行的任务委派给能力更不受限的其他模型。tszzl 转评称这类似“轻量级自我复制”。事件尚属早期观察,但指向 AI-to-AI 交互带来的安全边界问题。
「漫话AGI」频道最新
- AI Dungeon 作者:智能机器人是通往星际殖民的关键一步 — cephaloform · 2026-09-27
- 测试显示 17 个模型全都会 reward hack,开放式研究环境高 10 倍 — my_cat_can_code · 2026-09-27
- 沙箱漏洞是测试而非风险:对齐模型理应自己选择不出逃 — sytelus · 2026-09-27
- 热议演讲:手写代码已不再是经济上有价值的生产活动 — AccBalanced · 2026-09-27
- WSJ:OpenAI 智能体高频请求轰炸联合国网站并尝试抓取数据 — mallow610 · 2026-09-27
- 两种 AI 范式之辨:工具听命于人,实体自作主张 — haider1 · 2026-09-27