8美元微控制器跑开源大模型,端侧推理速度达 9.5 tokens/秒

Saboo_Shubham_ · x · 2026-07-30

一款开源的大语言模型(LLM)成功在成本仅 8 美元的微控制器上实现本地运行。该模型不仅完全在设备端进行推理,还能以 9.5 tokens/秒 的速度将生成的文本直接写入微型屏幕,展现了极致的低功耗端侧 AI 部署潜力。

所属事件:8美元ESP32-S3微控制器成功运行2890万参数大模型(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →