Rust+Vulkan 原生训练后端,支持 143 种 Transformer 架构

PhysicsDisastrous462 · reddit · 2026-09-17

开发者发布 Hierarchos-Native 项目,用 Rust + Vulkan 实现了一套原生训练/推理后端,覆盖 143 种标准 Transformer 架构,加上 Hugging Face modeltype 别名后注册表达 224 种模型类型拼写,全程不依赖 CUDA 或 PyTorch。

后端已实现的能力包括:

架构注册表覆盖 Llama、Qwen、Gemma、Mistral/Mixtral、DeepSeek、Phi、OLMo、Granite、Cohere、BERT 系、T5/BART 系等,并针对新模型设计了专用 Vulkan kernel,而非用单一通用近似硬套。

作者明确声明:目前不宣称这是 CUDA/PyTorch 的替代品,支持某模型类型也不代表其所有配置和多模态组件都已验证——注册表描述的是原生文本图实现,多模态包中的视觉/音频塔不在原生文本后端内,真实兼容性仍需更广泛的模型与硬件测试。

其价值在于方向:Vulkan 横跨 NVIDIA、AMD、Intel 及大量集显/移动硬件,若原生训练栈成熟,有望让 ML 训练基础设施不再绑定单一厂商生态。作者在 AMD RDNA 3 硬件(含 ROG Ally Z1 Extreme)上开发测试,便于暴露只围绕高端 CUDA 系统开发时被忽略的假设。仓库含 Rust 源码、Vulkan compute shader/SPIR-V、CLI、运行时、架构文档与验证工具。

所属事件:开发者用 Rust+Vulkan 实现训练后端覆盖 143 种架构(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →