arXiv论文:LLM嵌入学习中的推理坍塌与CoFree框架
_reachsumit · x · 2026-09-18
中国人民大学等团队的 arXiv 论文《Reasoning Quality Matters》指出,用 LLM 生成推理来优化文本嵌入时会出现"推理坍塌":面向嵌入目标的特化会抑制有用的推理生成,或产生与检索无关的文本。
论文提出两阶段框架 CoFree:第一阶段用参考引导的监督微调恢复基础嵌入模型的推理能力并保留表征强度;第二阶段在强化学习中引入嵌入导向与推理导向的双奖励,保证对检索目标相关性的细粒度推理,把嵌入学习从静态对齐变成推理引导的搜索过程。实验显示 CoFree-4B 在多项基准上取得领先的平均表现。
「研究」频道最新
- AI Agent 助建 scBaseCount:统一处理超 5.02 亿单细胞数据登 Cell — anshulkundaje · 2026-09-18
- Google 发布 ToolGrad:先生成答案再生成问题,高效造工具调用数据集 — AxSaucedo · 2026-09-18
- 心理学老坑重演:个体内认知剖面差异几乎没有意义 — soumitrashukla9 · 2026-09-18
- Cremieux 长文:整体直觉判断是人性的傲慢,统计模型更可靠 — soumitrashukla9 · 2026-09-18
- 实证研究拆解编码 Agent Harness 设计:哪些组件真正有效 — SinclairWang1 · 2026-09-18
- NVIDIA 提出 NOOA:把 agent 建模成 Python 对象 — Arindam_1729 · 2026-09-18