BetterGPT-150M 发布:1.52 亿参数、150 亿 token 训练的基础模型

Rich-Title-3668 · reddit · 2026-07-29

作者发布了 BetterGPT-150M,这是一个约 1.52 亿参数 的轻量级 causal language model,训练数据约 150 亿 token。

帖子给出的要点包括:

作者还提供了 GitHub 仓库、Hugging Face 模型页和一个在线 Space demo,并说明这只是基础续写模型,还没有做 instruction tuning。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →