QuixiAI 展示在 AMD MI300X 上运行模型的优化方案:支持 gguf 和自定义 HIP 内核
QuixiAI · x · 2026-07-30
QuixiAI 发布针对 AMD MI300X 硬件的模型推理优化方案,支持 gguf 格式、自定义 HIP 内核,内置 dspark 和 turboquant 支持,加载时间比 vLLM 和 llama.cpp 更快。
所属事件:QuixiAI 开源针对 AMD MI300X 的优化 Kernel 库(2 条相关)→
「Infra」频道最新
- Buildcleaner 开源工具可清理 443GB 构建缓存,免费 MIT 许可 — jasonkneen · 2026-07-30
- 大模型推理成本骤降:B200 单价已跌破 3 美元 — AccBalanced · 2026-07-30
- Yann LeCun 等探讨:LLM 是新型编译器,性能取决于算力 — yisongyue · 2026-07-30
- 高盛预测AI Token月处理量到2030年将激增70倍 — Beth_Kindig · 2026-07-30
- 244 GiB 大模型冷启动实测:耗时约 154 秒 — QuixiAI · 2026-07-30
- FP8 统一用于训练与推理解码,RL 端到端提速 16% — joecole · 2026-07-30