独立开发者实测:纯 CPU 跑 10B 模型达 113-130 tok/s,但质量拉胯

WildPino25 · reddit · 2026-09-15

Reddit 用户 WildPino25 展示自研的面向 CPU 内存约束的 LLM 架构 SiliconLLM:10B 参数模型在 Ryzen 5 3600X(无 GPU)上达到 113-130 tok/s,但权重质量很差。为验证质量能否在规模化下保持,他尝试在 T4 上训练 206M 模型(需 8 周以上),并尝试把 Qwen2.5-Coder 转换为其 SSM/三值/稀疏格式,发现改造 transformer 供体模型非常困难。代码与研究分支开源在 GitHub。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →