Rust+Vulkan 实现训练后端,覆盖 143 种 Transformer 架构

PhysicsDisastrous462 · reddit · 2026-09-17

开发者 necat101 发布开源项目 Hierarchos Native:用 Rust + Vulkan compute 从零实现的训练/推理后端,不依赖 CUDA 或 PyTorch,支持 143 种主流 Transformer 架构(含 HF 别名共 224 种 model-type 拼写)。

已实现的原生组件:

覆盖架构:Llama、Qwen、Gemma、Mistral/Mixtral、DeepSeek、Phi、OLMo、Granite、Cohere、BERT 系、T5/BART 系等,并为新模型设计写了架构专属 Vulkan kernel,而非统一近似。

定位与局限:作者明确不宣称是 CUDA/PyTorch 替代品,只支持原生文本图,多模态 tower 不在范围内,性能与硬件兼容性仍待独立测试。开发测试在 AMD RDNA 3 上进行(包括 ROG Ally Z1 Extreme 掌机),暴露了高端 CUDA 生态下不易察觉的假设。

意义:Vulkan 跨 NVIDIA/AMD/Intel 及集成显卡可用,若此类原生训练栈成熟,ML 训练基础设施有机会摆脱单一厂商算力生态绑定。

所属事件:开发者用 Rust+Vulkan 实现训练后端覆盖 143 种架构(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →