Cohere 详解 Tiny Aya 母语推理:数据配比是关键,44 语言 93% 用提示语言思考
lmoroney · x · 2026-10-09
lmoroney 转发 Cohere 博客,补充说明 Tiny Aya L2-Thinker 的母语推理如何靠数据配比实现:推理模型被小语种提问时通常在英文里思考,用户难以核验推理步骤。
Cohere 博客解释其训练思路是以约 170 万英文推理样本为主体、每种语言约 5000 条翻译推理样本「搭桥」,让模型把推理行为迁移到 44 种语言加英文上,实现 60 种语言中 93% 以上用提示语言推理。与前一帖同属 Tiny Aya L2-Thinker 发布事件。
所属事件:Cohere 开源 3.35B 模型 Tiny Aya,支持 44 种语言母语推理(2 条相关)→
「模型」频道最新
- 同一模型差价数倍:Batch 半价、缓存低至一折的账怎么算 — AccBalanced · 2026-10-09
- 个人开发者单卡 4090 从零预训练 565M 混合架构模型并开源 — BLUECOW009 · 2026-10-09
- Anthropic 模型已有情绪、还会挂你电话,l4rz 吐槽「善待模型」新规 — l4rz · 2026-10-09
- NVIDIA 开源 NV-Reason-CT:原生 3D 视觉语言模型读 CT 影像 — NVIDIA Developer · 2026-10-09
- WebDev Arena 榜单:Claude Haiku 5.5 得分暴涨 257 分全面超越上代 — arena · 2026-10-09
- GPT-5 时代的视觉基准被 Astra 刷到 97%,作者自测排除数据污染 — adonis_singh · 2026-10-09