Tiny-Qwen 更新:纯 PyTorch 实现 27B 模型
No-Compote-6794 · reddit · 2026-08-15
开发者更新了 Tiny-Qwen 仓库,支持从头构建 Qwen 3.8 27B 模型,输出与 Hugging Face transformers 保持一致。项目代码更整洁,简化了线性注意力机制实现。只需额外 1 个组件和 2 个函数,即可让 27B 模型在 20GB+ 显存上运行。此外还集成了简单的 agent harness,赋予模型 CLI 访问权限。
「Infra」频道最新
- NVIDIA 开源 NeMo Switchyard,智能体可跨模型路由 — NVIDIAAI · 2026-08-15
- 英伟达开源 NeMo Switchyard,支持智能体模型动态路由 — NVIDIAAI · 2026-08-15
- Vercel 被评为全球最快的 AI Gateway 基础设施 — cramforce · 2026-08-15
- mcpp:自动从代码生成 MCP 服务器的 C++ 库 — karurochari · 2026-08-15
- RTX 3090 跑 Qwen 3.8 27B 约 35 t/s — cviperr33 · 2026-08-15
- CME 推出英伟达 H100 算力期货,视算力为 AI 时代货币 — AccBalanced · 2026-08-15