8美元ESP32跑大模型:28.9M参数实现10 tokens/秒

FinanceYF5 · x · 2026-08-06

开发者成功在价值仅 8 美元的 ESP32-S3 微控制器上,实现了完全本地运行的大语言模型(LLM)并用于打造咖啡师 AI。

核心技术指标:

技术实现:

由于微控制器的高速内存极小,开发者借鉴了 Google Gemma 3n 的 Per-Layer Embeddings 技术。通过将大部分模型权重转移至闪存,仅保留频繁访问的激活值和归一化权重在 SRAM 中,成功突破了内存瓶颈,实现了无云、无 GPU 的纯端侧 AI 推理。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →