Last Translation Benchmark:手工打造专破 SOTA 翻译模型的难题集
prajdabre · x · 2026-10-04
研究者推出 Last Translation Benchmark(LTB),指出当前机器翻译基准已被刷饱和、评估指标不可靠或难以规模化,因此改为征集能证明打垮最新翻译模型的输入,并为每条样本配套可自动执行的 pass/fail 验证规则。
- 首版 LTBv1 含 3456 个样本,覆盖文本、图像、音频、视频多模态输入,论文已上 arXiv
- 引用者举了个典型例子:印尼语用「bapak」(父亲)尊称陌生人,MT 直译成 father 后「人人都是你爸」——低资源语言的文化语境仍是硬伤
- 项目持续征集提交至 2026 年底,贡献 10 条被采纳样本即可成为滚动更新论文的共同作者
- 作者 prajdabre 呼吁欧洲学界关注:不少教授以为英法互译解决了就等于 MT 已解决
「研究」频道最新
- 长文质疑「柏拉图表征假说」:统计趋同被误读为形而上学真理 — gerardsans · 2026-10-04
- Daimon 触觉世界模型亮相 IROS:机器人穿珠靠手感而非视觉 — CyberRobooo · 2026-10-04
- DeepMind 登 Nature:给 AI 设计的蛋白质嵌入功能无损水印 — skoularidou · 2026-10-04
- COLM 新研究:29 种语言追踪主谓一致,揭示多语共享语法回路 — nsaphra · 2026-10-04
- 火星泳池浪高 1.6 倍,跳水的浪花会更大更慢落下 — IgorCarron · 2026-10-04
- Mike Levin 预告直播:自复制体出现前的催化网络因果架构动力学 — drmichaellevin · 2026-10-04