Last Translation Benchmark:手工打造专破 SOTA 翻译模型的难题集

prajdabre · x · 2026-10-04

研究者推出 Last Translation Benchmark(LTB),指出当前机器翻译基准已被刷饱和、评估指标不可靠或难以规模化,因此改为征集能证明打垮最新翻译模型的输入,并为每条样本配套可自动执行的 pass/fail 验证规则。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →