ktransformers:24GB显存跑大模型

dosco · x · 2026-07-18

Tsinghua 团队的 ktransformers 用一种很直接的方式优化 MoE 模型部署:

所属事件:ktransformers支持24G显存本地运行超大模型(4 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →