前沿模型仍会翻车于精确复制

dair_ai · x · 2026-07-21

关键信息

前沿语言模型虽然能做复杂推理,但在一个看似简单的能力上仍会翻车:准确复制一大段文本。

为什么重要

论文指出,这不只是“抄文本”这么简单。代码、表格、结构化文档,以及很多 agent 工作流,都依赖模型稳定地保持原文格式与顺序。

方法

作者认为问题与 Transformer 的位置编码有关,于是提出把文本从 1D token 序列改成 2D 布局 来看,并设计 2D-RoPE:给每个 token 分配行号和列号,把复制任务变成更容易的检索问题。

结果

结论

作者认为,把文本视为 2D 结构可能有助于语言建模,2D 位置编码值得进一步探索。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →