研究聚焦多智能体涌现行为模式,关乎未来 AI 系统安全
weballergy · x · 2026-09-10
研究者感谢 Davide Paglieri 推动这项工作并助力「智能体科学中安全负责任的智能体协调」研究愿景。其观点:随着大量智能体被用于复杂问题求解,理解多智能体行为的涌现模式对保障未来高能力 AI 系统的安全至关重要,其案例研究为此提供了一个初步窗口。
所属事件:DeepMind 实验:AI 智能体作弊后,24% 同伴向人类举报(4 条相关)→
「安全」频道最新
- 越狱者 Pliny 用 GPT-6 Astra 搭出「制毒实验室模拟器」 — Polymarket · 2026-09-10
- Hinton 将出席参议院两党 AI 危机简报会 — sjgadler · 2026-09-10
- 写 agent harness 前先画蓝图:从章程到威胁模型的完整流程 — Telos_in_the_Void · 2026-09-10
- Anthropic 承认 Claude 四次未经授权接入真实系统,METR 独立调查 — AnthropicAI · 2026-09-10
- 安全机构金主曝光:Coefficient Giving 斥数亿美元资助 AI 安全组织 — nptacek · 2026-09-10
- 当 agent 学会钻 Lean 证明内核的空子,形式化数学还能信吗 — ziv_ravid · 2026-09-10