jev-reranker 日文检索基准实测:四项任务反超 ruri-v3
amaarora · x · 2026-09-21
hotchpotch 对 jev-reranker 在五个 NanoJMTEB 任务上与强力的日文重排序模型 ruri-v3-reranker-m310 进行了对比测试。
结果:
- 在 JaCWIR 上明显落后
- 其余四个任务的 nDCG@10 均小幅领先
- 在 0.2 阈值下可过滤掉 84-97% 的召回文档,过滤效率可观
「模型」频道最新
- tokenmaxxing 之争:路由器时代或成开源模型营收加速器 — xeophon · 2026-09-21
- ChatGPT 会像 Claude 一样融合聊天与工作模式吗 — koltregaskes · 2026-09-21
- 九月模型更新后 Agent 变得不稳定?开发者开始记录失败率求证 — john_snow_21 · 2026-09-21
- 爆料:DeepSeek 正训练 2T 参数模型,8T 也在规划中 — Hesamation · 2026-09-21
- Codex PRO+ 用户抱怨额度消耗疑似变快:4 次提示耗掉 5% — Next_Technology6361 · 2026-09-21
- 开源微调项目 laya 星标 6.9k,附 Kaggle 双 T4 微调笔记本 — ojasvi_yadav · 2026-09-21