异构 LLM 优化框架 ktransformers
kvcache-ai · github · 2026-07-19
`ktransformers` 是一个用于体验 **异构 LLM 推理/微调优化** 的灵活框架,核心关注点是如何在不同硬件与执行路径上做性能优化。 项目是 Python 实现,GitHub 约 **1.8 万 stars**,当天新增 **328**。配图显示其定位为 heterogenous inference / fine-tune optimizations,偏推理加速与训练优化基础设施。
所属事件:ktransformers支持24G显存本地运行超大模型(4 条相关)→
「Infra」频道最新
- 路由故障让 Claude Code 智能体 3.5 小时烧掉 3020 万 token — RileyRalmuto · 2026-07-21
- 单集群可扩至50万卡,华为Atlas 950 SuperPoD算力架构曝光 — pstAsiatech · 2026-07-21
- 韩国七月前 20 天出口增逾五成,AI 芯片带动 — Polymarket · 2026-07-21
- Bittensor 阵营称去中心化训练可抵消数倍算力差距 — markjeffrey · 2026-07-21
- Cloudflare 验证页开始识别 AI 代理而不只是人类 — shashib · 2026-07-21
- 多节点 vLLM 经过拓扑调优,单用户吞吐升至 47 tok/s — TheZachMueller · 2026-07-21