Reliquary-4B 发布:全网矿工贡献 rollout 的去中心化 RL 训练数学代码模型
const_reborn · x · 2026-09-22
Reliquary 团队发布 Reliquary-4B,一个专注数学与代码的 4B 模型,通过强化学习训练。其最大特色是训练过程去中心化:任何人都可以加入网络贡献 rollout,由独立矿工自选 prompt 并生成 rollout,协议负责验证并用这些数据训练模型。
作者称这标志着「去中心化后训练模型在其类别中击败前沿水平」的时代的开始。模型权重与背后研究已公开。
「模型」频道最新
- 实测 105 个真实 bug:Grok 4.7 得 28.7 分,未胜 Grok 4.6 — PawelHuryn · 2026-09-22
- 曝 OpenAI 正测试 Aeon 持久推理模式,任务不完成不停止 — imjustnewatai · 2026-09-22
- 四大模型横评:GPT-6 Astra 与 Claude Fable 5.1 领跑 40 余项基准 — HealthySkeptic2000 · 2026-09-22
- Grok 4.7 xHigh 距登顶仅 1 分:58% 对 Claude Fable 5.1 Max 的 59% — XFreeze · 2026-09-22
- 让两大前沿模型操纵真实机器人玩夺旗,Gemini 以 70% 胜率碾压对手 — chris_j_paxton · 2026-09-22
- ChatGPT Pro 的 Chat 模式首次出现限速提示,细节不明 — pred · 2026-09-22