mLateOn模型未训练韩语却登顶 MTEB 韩语检索榜首
IgorCarron · x · 2026-08-07
antoinechaffin 分享了 mLateOn 模型在 MTEB 韩语检索任务上的测试结果。尽管该模型在训练过程中完全没有使用过任何韩语数据,但依然取得了当前最优(SOTA)的成绩,不仅超越了参数量大得多的模型,甚至逼近了专门的 80 亿参数韩语模型。作者指出,这种完全跨领域的出色表现正是得益于“后期交互”(late interaction)机制。
「模型」频道最新
- Grok Voice 全栈自研:0.7秒低延迟与实时工具调用 — Daniel_Farinax · 2026-08-07
- 教授惊叹 Gemini 前沿能力掉队,企业客户被绑引担忧 — emollick · 2026-08-07
- 纯 MLX 跑通 Nemotron Omni:Mac 端实现视觉音频推理 — divinetribe1 · 2026-08-07
- Kimi K3 开源模型正式上线 GitHub Copilot,主打高性价比 Agent 编码 — 0xkarasy · 2026-08-07
- 张一鸣内部定调拒绝蒸馏,DeepSeek 宣布大幅上调 API 定价 — pstAsiatech · 2026-08-07
- 英伟达发文阐述 Nemotron 开源模型优势:助力企业定制专属 AI — nvidia · 2026-08-07