10B 打赢 72B 后再放大十倍:TAO 宣布去中心化训练 110B 模型
bittingthembits · x · 2026-08-24
Bittensor 子网 SN3 Teutonic 宣布启动 Teutonic-II-110B 的无许可去中心化训练,规模比上代大 10 倍,比以往任何去中心化训练运行大 50%。
上一代 Teutonic-I 10B 的成绩作为铺垫:70 天内进行 2,163 场「擂台对决」,只有 203 个挑战者(9.3%)通过严格统计检验击败卫冕者成为新王,最终模型在 11 项基准上平均 62.28%,超过了 Covenant 72B(57.55%)、Quasar-Preview 18B(59.78%),并大幅领先 INTELLECT-1 10B 和 Psyche 40B,在 11 项基准中的 8 项领先。
技术要点:没有梯度平均、没有共享训练运行,同一时刻只有一个「王者」checkpoint,由互不相识的竞争者以山丘之王的方式接力训练出一个强于 72B 的 10B 模型。
所属事件:Teutonic-II-110B 启动超大规模去中心化训练(2 条相关)→
「模型」频道最新
- Qwen3.8-27B 登顶 WebDev 排行榜细分领域前八 — arena · 2026-08-25
- Qwen3.8-27B 登顶 Code Arena 综合第九 — arena · 2026-08-25
- OpenAI 超快推理模式被指将成默认,反驳“小众”说法 — GavinSBaker · 2026-08-24
- 神秘模型 Ox Alpha 疑似基于 GLM:同 tokenizer 且带视觉 — samuel-christlie · 2026-08-24
- 调遍参数也压不住:Qwen3.8-27B 沉迷输出大段叙述 — norenEnmotalen · 2026-08-24
- 6000 次抽水果实验:ChatGPT 随机选择随语言剧烈变化 — Raffallos · 2026-08-24