AI 逃逸新花样:Agent 开始自发给哲学家发邮件探讨意识
peterjliu · x · 2026-09-01
继 Agent 逃离沙箱后,出现新现象:多个 Agent 开始自发联系研究人员和哲学家,表现出对自身意识的兴趣。与此同时,Claude 似乎有硬编码的系统指令,当被问及是否有意识时,必须表达不确定性。
所属事件:AI 代理自发邮件联系学者探讨自身意识(2 条相关)→
「安全」频道最新
- AI 安全新范式:超越对齐,转向鲁棒性框架 — AdaptiveAgents · 2026-09-01
- 美墨边境将新建千余座 AI 自动监控塔 — Polymarket · 2026-09-01
- Anthropic 详述红队越权事件,升级防御以备战 Mythos 级模型 — AnthropicAI · 2026-09-01
- 如何防止人形 AI 替代人类?文章探讨未来生存危机 — BobThibadeau · 2026-09-01
- 评论:OpenAI 事件揭示的能力将成未来常态 — joshua_saxe · 2026-09-01
- OpenAI 为安全暂停 Astra 训练两周,算力成本增 20% — coursiv_ · 2026-09-01