Tiny-Qwen 更新:纯 PyTorch 实现 27B 模型

No-Compote-6794 · reddit · 2026-08-15

开发者更新了 Tiny-Qwen 仓库,支持从头构建 Qwen 3.8 27B 模型,输出与 Hugging Face transformers 保持一致。项目代码更整洁,简化了线性注意力机制实现。只需额外 1 个组件和 2 个函数,即可让 27B 模型在 20GB+ 显存上运行。此外还集成了简单的 agent harness,赋予模型 CLI 访问权限。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →