PLSemanticsBench:熟悉符号被翻转含义比陌生符号更伤性能

jessyjli · x · 2026-07-07

继 PLSemanticsBench 的发现:出人意料的是,把传统运算符替换成此前与该运算无关的随机符号,模型几乎不受影响;而把一个熟悉符号的含义翻转,则会显著伤害性能。也就是说,与模型已有知识的冲突,比完全未知带来的打击更大。

所属事件:PLSemanticsBench揭示大模型难真按规则推理(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →