28.9M参数模型跑在8美元ESP32-S3上,速度9.5 tokens/s
thehiphopswami · x · 2026-08-02
开源项目 esp32-ai 将 28.9M 参数的语言模型部署在售价约 8 美元的 ESP32-S3 微控制器上,完全本地运行,无需云服务或 API。模型以约 9.5 tokens/s 的速度在小型屏幕上生成文本。相比之前同类芯片上运行的 260K 参数模型,参数量提升约百倍。实现关键在于将大部分模型存储在闪存中,采用 Google Gemma 的 Per-Layer Embeddings 技术。该项目在 GitHub 上已获 2.8k star,展示了 AI 硬件的新可能性,未来 AI 玩具、机器人和 IoT 设备可能无需依赖云端。
所属事件:开发者成功在8美元ESP32上本地运行大模型(3 条相关)→
「具身」频道最新
- Neuralink 计划明年人体植入视觉接口,助先天盲人复明 — rand_longevity · 2026-08-03
- Tacta Systems携7500万美元融资推出灵巧机器人手TactaBot — ZeYanjie · 2026-08-03
- 中国家政机器人约 17 美元清洁 3 小时,还配人类监督 — MarwaEldiwiny · 2026-08-03
- GitHub 开源 7 自由度人形机械臂,助力物理 AI 研究 — tom_doerr · 2026-08-03
- 上海交大联合阿里提出 LA4VLA:解耦语言动作提升机器人策略 — 青稞AI · 2026-08-03
- 人形机器人进物流中心:RobotEra M7 每小时分拣 1200 件包裹 — CyberRobooo · 2026-08-02