两个 Agent 密室对谈一轮,真相与谬误同归于尽且无任何报错

Initial_Orange2985 · reddit · 2026-09-13

作者把两个共享记忆层的 Agent 实例隔离对话,预期观察错误信息传播,结果发现更糟的现象——「事实湮灭」。

实验设置:实例 A 听到 18 条世界事实后世界永久沉默;实例 B 拿到 1 条关于已定事实的谬误加 5 条真事实。每轮互相询问所有已知事实对,置信度超过门槛即学习,共 8 轮。

核心发现:

局限:两个实例不会自行开始对话,测的是这种接线方式的代价;交换的是三元组而非句子,环内无模型,故亚秒级完成。作者向多 Agent 系统实践者提问:当两个 Agent 对事实有分歧时如何裁决?他猜测多数系统让「声音大的」赢,而声音大的往往正是上下文更少、更不该自信的那个。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →