「最后的翻译基准」上线,专攻主流翻译模型弱点

针对现有翻译基准饱和、评测指标不可靠的问题,The Last Translation Benchmark 以「活论文+数据集」形式上线 Hugging Face,提供经同行评审的多模态样例和人工验证规则,专门覆盖能击穿主流翻译模型的难点场景。项目持续更新并开放贡献,贡献者提交 10 条获批样本即可获得共同署名。

2026-09-04 ~ 2026-09-04 · 2 条相关