Last Translation Benchmark 开放贡献:10 条获批即可共同署名

zouharvi · x · 2026-09-04

Last Translation Benchmark 是一个持续更新的「live paper + 数据集」,目前仍开放贡献。该项目针对现有翻译基准饱和、评测指标不可靠的问题,收集能证明让最先进翻译模型出错的输入(文本/图像/音频/视频),并要求贡献者提供可自动判定的 pass/fail 验证规则。获批 10 条以上提交的贡献者可获 live 论文共同署名;数据集 LTBv1 已含 3456 条样例(90MB),上线 Hugging Face 排行榜,后续滚动发布新版本。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →