小米开源多语言翻译模型,超越主流闭源基线
xiaomi-research · hf · 2026-08-12
小米研究团队提出了一种针对开源大语言模型的无参考后训练方法,专门用于提升多语言机器翻译能力。
该方法结合了无参考质量奖励的 GRPO(Group Relative Policy Optimization)以及检查点插值技术。实验表明,经过这种后训练优化的开源模型,其翻译效果不仅超越了其他强劲的开源模型,甚至击败了主流的专有闭源基线。
「模型」频道最新
- Meta 发布 Muse Glimmer:30B 开源端侧智能体模型 — TimDarcet · 2026-08-12
- FLUX 3 视频模型冲上 Arena 第二,仅落后 Gemini 16 分 — arena · 2026-08-12
- 遵守欧盟AI法案,Anthropic将为Claude全球生成文本嵌入水印 — TinfoilTricorn · 2026-08-12
- AI 安全护栏误杀:素数多项式证明为何被拦截? — chaumian · 2026-08-12
- DeepSeek前缀缓存优化实战:单次Agent任务成本降至0.005美元 — BodybuilderLost328 · 2026-08-12
- 端侧MoE模型实测:NVIDIA Lightning比Qwen快2.5倍 — parepeg · 2026-08-12