开发者成功在8美元ESP32上本地运行大模型
开源项目esp32-ai展示了极低成本的端侧AI部署实践。开发者借鉴Google Gemma模型的量化技巧,成功将一个2890万参数的语言模型部署到仅售8美元的ESP32-S3微控制器上。该模型完全本地运行,无需云服务或API,生成速度可达约9.5 tokens/s,展现了生成式AI在微型硬件上的潜力。
2026-08-02 ~ 2026-08-03 · 3 条相关
- 28.9M参数模型跑在8美元ESP32-S3上,速度9.5 tokens/s — thehiphopswami · 2026-08-02
- 8美元跑大模型:开发者将2900万参数LLM塞进ESP32 — DynamicWebPaige · 2026-08-02
- 仅需 8 美元:成功在 ESP32 芯片上运行 Google Gemma 模型 — DynamicWebPaige · 2026-08-03