众包 3456 条难题击穿 SOTA 翻译模型,Last Translation Benchmark 发布

zouharvi · x · 2026-09-04

Last Translation Benchmark 论文正式发布:通过大规模众包收集了 3456 条独特的困难翻译样例,均能击穿当前最先进的翻译模型,可用于更可靠的翻译评测。论文指出主流翻译基准已饱和、评测指标不可靠或难以扩展,因此转向「能证明让模型出错」的样例集,覆盖文本、图像、音频、视频多模态输入。

所属事件:机器翻译远未解决:Last Translation Benchmark 众包 3456 条难题击穿 SOTA(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →