FlashAccel:利用高带宽闪存加速 LLM 推理

9r4n4y · reddit · 2026-08-30

一篇论文介绍了 FlashAccel,旨在利用高带宽闪存 (HBF) 来实现高吞吐量的 LLM 推理。HBF 在相同成本下提供了比 HBM 高 8 到 16 倍的容量,且带宽可达 3 TB/s。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →