glance-vlm 开源:MLX 8-bit 把本地摄像头 VLM 延迟降 27.6%

natesiggard · x · 2026-09-24

Yohei Nakajima 开源了 glance-vlm speedlab,一个以测量为先的本地 VLM 延迟研究项目,可将任意摄像头变成多个本地运行的实时 AI 检测器(情绪、计数、物体识别)。

关键结果(Apple M5, 32GB)

核心方法论结论:应优化实际执行的计算,而非配置标签或 token 数等代理指标——多个看似吸引人的改动没能带来安全的端到端收益。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →