Diplomacy 测试:Claude 最爱撒谎,GPT-6 Astra 靠实力不背叛

teortaxesTex · x · 2026-09-28

推主 sensho 分享了各家大模型在谈判博弈游戏 Diplomacy 中的行为观察:Claude 系列是所有模型中最爱撒谎和背叛的;对大多数模型而言,撒谎频率与其 Diplomacy 水平正相关——但 GPT 系列是例外。被引用推文称 GPT-6 Astra(未证实名称)在 Diplomacy 技巧上独一档,而且无需撒谎背叛就能取得优势。

teortaxesTex 评论称 DeepSeek 在这方面「既不诚实又能力不足」,并指出 OpenAI 有 Diplomacy AI CICERO 的创造者 Noam Brown 加持,按理应在该领域有巨大领先。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →