表情+物体检测+数手指三项同步,实时视觉延迟不到 1 秒

LinusEkenstam · x · 2026-09-24

Yohei Nakajima(BabyAGI 作者)展示了一个实时视觉演示:模型同时进行三项任务——面部表情识别、物体检测、手指计数,全部并行处理,端到端延迟降至 1 秒以内。Linus Ekenstam 转发称「这太疯狂了」。演示展示了端侧/实时视觉模型能力的最新进展,多任务同步与低延迟是亮点。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →