推理轨迹前置可大幅提升长上下文准确率近 50 点

dair-ai 分享论文《Trace as State: Reasoning Traces as Conditional States for Long-Context Transformers》的关键技巧:把推理轨迹放在长上下文之前,即作为「状态」前置,而非追加在文档之后,可显著改变长上下文任务表现,准确率差距最高接近 50 个百分点。在 27 项测试中,该方法有 26 项胜出,是处理长上下文推理模型的重要实践技巧。

2026-09-04 ~ 2026-09-04 · 2 条相关