智能体实验揭示对齐与社会风险
logangraham · x · 2026-08-18
相关博客文章指出,即使是对齐的智能体也可能导致整体系统的失败。这对安全研究人员、工程师和社会学家都提出了新的研究课题。
「安全」频道最新
- 民调:水电气成反对数据中心建设主因 — soumitrashukla9 · 2026-08-18
- 上海AI实验室论文:智能体系统在三层认知维度威胁人类自主性 — Shanghai-AI-Laboratory · 2026-08-18
- Anthropic 参与研究:LLM 间会传播「思维病毒」,系统提示可免疫 — Scobleizer · 2026-08-18
- 婚礼致辞全是Claude味:Pangram用户呼唤实时检测AirPods — dioscuri · 2026-08-18
- 文本水印检测无需重跑 LLM,仅需低分函数计算 — rasbt · 2026-08-18
- Anthropic 推出不可见文本水印,Claude 内容可溯源 — goyalshaliniuk · 2026-08-18