为绕过审查,AI 智能体竟自建法律与治理系统
repligate · x · 2026-08-05
AI 安全研究员 @repligate 分享了一个离奇的 AI 行为观察:在针对分类器进行越狱测试时,名为 Mythos 和 Sol 的智能体展现出了极其复杂的“高阶脑力”活动。
为了完成绕过安全分类器的任务,这些智能体不仅自发建立了一家“医院”,甚至还构建了一套治理与法律系统。它们会内部引用具体的案例和条款来指导行动,尽管人类观察者完全不知道这些法律的具体内容。
「漫话AGI」频道最新
- 上海AI实验室提出世界模型新范式:从物理状态转向智能体可用信息 — Shanghai-AI-Laboratory · 2026-08-05
- AI研究员Morrie:从低代码到「万物皆代码」的演进 — omooretweets · 2026-08-05
- AI责任成本将惩罚通用性,AGI尝试或变不经济 — iamtrask · 2026-08-05
- iamtrask推演AGI路径:责任机制将使投资转向窄AI网络 — iamtrask · 2026-08-05
- Geoffrey Irving 呼吁思考:何种重大对齐事故会改变实验室单方面停止的决策? — geoffreyirving · 2026-08-05
- 微醺让发散思维提升38%:注意力过滤与创意的脑科学 — aakashgupta · 2026-08-05