1000 美元训出 HRM-Text,Sapient 递归架构抢在 Astra 之前押注
rohanpaul_ai · x · 2026-09-06
Sapient 于 2025 年 6 月提出「分层推理模型 HRM」,并于今年 5 月开源了 HRM-Text 文本模型。核心思路是:推理可以通过循环递归地更新内部状态来「花算力」,而不只依赖常规 transformer 堆叠——这一方向如今随 OpenAI GPT-6 Astra 把 latent space 循环递归带入前沿话题而受到关注。
- HRM-Text 是约 1B 参数的开源模型,从零预训练,仅用 40B 唯一 token,GPU 成本约 1000 美元
- 附带完整预训练框架,可自行探索、训练和改进
- Sapient 强调自己在缺乏行业验证前就做出该研究决策并开源可复现成果
所属事件:Sapient 开源 HRM-Text 递归推理模型下载量破 25 万(2 条相关)→
「模型」频道最新
- 用户反馈 Codex 应用端 Luna Max 消失,网页版仍可用 — Clear_Skye_ · 2026-09-06
- 同一个梦,两种文风:Fable 梦在散文,Astra 梦在数字 — teortaxesTex · 2026-09-06
- 自建空间推理基准被 Astra 全部打穿,作者直呼 VLM 视觉已解决 — pbaylies · 2026-09-06
- 传 Altman 回归数月即凭 Astra「碾压」Dario,e/acc 领袖开嘲 — beffjezos · 2026-09-06
- e/acc 领袖力捧 OpenAI Astra:用过直言「Claude 已审美疲劳」 — beffjezos · 2026-09-06
- 用户实测 Astra:模型很强但爱提前收工,需反复催促才继续干活 — ivan_bezdomny · 2026-09-06