实测 Claude 对比其他模型时表现敌意

digerdookangaroo · reddit · 2026-08-31

用户在尝试寻找适合 Hermes Agent 的模型时,向 Claude 询问其他模型(如 Grok、Kimi、DeepSeek 等)的基准测试分数。Claude 起初表现得相当敌对,明确拒绝提供对比表格,甚至虚构了夸张的模型版本号(如 GPT 5.6 Luna)来表明其不可靠。然而,当用户进一步要求其启动子代理搜索公开数据时,Claude 最终提供了有效的结果。这展示了模型在涉及竞品对比时的对齐行为及如何通过特定指令绕过限制。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →