Luth-2 发布:刷新法语小模型 SOTA,0.8B 性能越级打大模型
Unusual_Shoe2671 · reddit · 2026-08-11
kurakurai 团队发布了全新的法语非推理小模型 Luth-2-0.8B 和 Luth-2-2B。两款模型在多项法语基准测试中打破了同参数量级的 SOTA,部分成绩甚至超越 3-4 倍体量的模型(如 Gemma-4-E2B-it 和 granite-4.0-h-micro)。
技术亮点:
- 采用全新的 30 亿 token SFT 混合数据集,涵盖数学、知识、代码、工具调用与多轮对话等领域。
- 引入专家强化学习与多领域策略蒸馏(MOPD)扩展模型能力。
- 底座架构迁移至 Qwen3.5,团队发现其对后训练的接受度显著提升。
模型权重、训练数据集与代码均已开源,适合在本地设备上高效运行。
「模型」频道最新
- UCL新研究用RL微调,解决大模型“撒谎”与隐瞒影响因子问题 — alex_verem · 2026-08-11
- Falcon-Perception:0.6B模型助力目标检测标注生成 — vanstriendaniel · 2026-08-11
- Claude 输出已加入隐形文本水印,引发用户移除探讨 — Franck_Dernoncourt · 2026-08-11
- 爆料称 9 月底迎大更新,下篇论文聚焦 Agent 与持续学习 — teortaxesTex · 2026-08-11
- Anthropic 将为所有 Claude 输出嵌入隐形水印 — The Decoder · 2026-08-11
- 爆料:DeepSeek V4 Pro 版本即将发布 — dejavucoder · 2026-08-11