Last Translation Benchmark 开放征稿:10 条入选可共同署名
zouharvi · x · 2026-10-08
zouharvi 等人发起的 Last Translation Benchmark (LTB) 正在持续征集投稿,针对现有机器翻译基准已饱和、评估指标不可靠或难扩展的问题:
- 做法:收集能被证明让最先进翻译模型出错的输入(文本/图像/音频/视频),并要求提交可自动验证的 pass/fail 规则
- 激励:每个被采纳的投稿计入署名;累计 10 条被采纳即可成为活页论文的共同作者,数据集与论文滚动更新至 2026 年底
- 进展:已有 LTBv1 数据集(3456 例,90MB)和 Hugging Face 排行榜;最新接入的模型包括 Cohere North Small Translate、Mistral Large 4、Qwen 3.8 等
- 欢迎各语种投稿者与自荐审稿人,代码与反馈在 GitHub 开放
所属事件:Last Translation Benchmark 开放征稿并收录新模型(2 条相关)→
「研究」频道最新
- LeCun 称形式化证明自动化开启数学新纪元,评论者:机器审不了「好问题」 — AryHHAry · 2026-10-08
- 陶哲轩转发 AHM 声明:OpenAI 突发 700 份数学文档是炫力非学术 — burny_tech · 2026-10-08
- RSIGym 让智能体自我改进模型,Opus 5 以 0.4809 居首 — teortaxesTex · 2026-10-08
- 树突启发循环单元 DIRU 论文发布,可用于新生儿癫痫脑电预测 — Dr_Alex_Crimi · 2026-10-08
- 数学形式化 Agent 会自动生成论文勘误供人工核对 — burny_tech · 2026-10-08
- arXiv 新论文:Lean 形式化智能体的证明路线与原论文不一致 — burny_tech · 2026-10-08