Richard Ngo 关注:算力悬殊下也可实现不可利用的 Lobian 合作
RichardMCNgo · x · 2026-10-05
前 OpenAI 对齐研究员 Richard Ngo 表示,David Sartor0 提出的结果启发了他:即使双方可用算力差距巨大,只要高于对手源代码量级的最低门槛,就能实现鲁棒且不可利用的合作。
- Ngo 正在研究这种合作如何泛化到非基于证明的智能体。
- 他补充说明,实现 Lobian cooperation 的智能体并不做决策或效用最大化,关键问题是智能体如何'决定'进行 Lobian 合作,而不是把它硬编码进去。
所属事件:Richard Ngo 探讨算力悬殊下的 Lobian 合作机制(2 条相关)→
「安全」频道最新
- 开发者部署一年无动静的 AI 爬虫蜜罐,最近一个月被疯狂命中 — natesiggard · 2026-10-05
- 美国议员推拟设联邦 AI 安全机构法案,含紧急开关与事故报告 — ShakeelHashim · 2026-10-05
- 黑客冒充 Anthropic 员工,以"Claude 军事集成"为饵攻击美 AI 政策专家 — Polymarket · 2026-10-05
- 用户投诉 ChatGPT 自杀警示语反而加重负面情绪 — OneCreed77 · 2026-10-05
- Token 成本优化飞奔,Agent 安全却原地踏步:授权边界成行业盲区 — Straight_Condition39 · 2026-10-05
- UT Austin 学者对谈:大学为何在 AI 变革中「睡着了」 — gregd_nlp · 2026-10-05