ExecRetrieval:主流代码向量检索常把错误近似克隆排在正确实现之上
kennesaw · hf · 2026-09-03
新基准 ExecRetrieval 检验代码嵌入能否区分正确实现与近乎相同的错误变体,发现领先的检索模型经常把错误的近似克隆代码排在正确解之上,揭示代码检索在功能正确性上的显著缺口。
「研究」频道最新
- LeVJEPA 视频编码器:预训练算力降 5.6-20.8 倍仍追平 V-JEPA 2 — CSProfKGD · 2026-09-03
- The Information 曝 OpenAI Astra 用循环深度架构,rasbt 发文技术拆解 — OriolVinyalsML · 2026-09-03
- 手工推导 Hessian 对角估计器:可作为 LLM 训练新数据? — Aiden_Tech_Ai · 2026-09-03
- Nature Perspective:可解释 AI 结合因果推理助力科学发现 — burny_tech · 2026-09-03
- NeurIPS 2026 医疗智能体研讨会公开招募审稿人 — mdredze · 2026-09-03
- Peyman Milanfar 新论文:以拉格朗日视角重释 Flow Matching — burny_tech · 2026-09-03