「最后的翻译基准」上线,专攻主流翻译模型弱点
针对现有翻译基准饱和、评测指标不可靠的问题,The Last Translation Benchmark 以「活论文+数据集」形式上线 Hugging Face,提供经同行评审的多模态样例和人工验证规则,专门覆盖能击穿主流翻译模型的难点场景。项目持续更新并开放贡献,贡献者提交 10 条获批样本即可获得共同署名。
2026-09-04 ~ 2026-09-04 · 2 条相关
- Last Translation Benchmark 开放贡献:10 条获批即可共同署名 — zouharvi · 2026-09-04
- 「最后的翻译基准」发布:多模态样本+人工验证规则击穿主流翻译模型 — Vilém Zouhar · 2026-09-04