自采数据+定制中训+自跑 RL,推理价格只要 Astra max 一半

hsu_byron · x · 2026-09-16

围绕 andrewho03 的质疑展开的讨论:有人认为花大力气自采数据、跑定制 midtrain、再做自己的 RL,最后性能只与 Astra max 持平但推理价格减半,「有点不值」。

转发者 madiator 持相反观点:能靠自己的数据管线和训练流程做到与前沿闭源模型同等性能、推理成本却只有一半,这件事本身非常了不起——而且想象一下接下来还能做什么。这反映了「自建 vs 闭源前沿」路线之争:复制前沿能力正变得越来越便宜。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →