Perceptron Multilook API:一次预填视频上下文,成本降至 32%

AkshatS07 · x · 2026-09-05

多模态 API 公司 Perceptron 发布 Multilook API,针对「同一个视频/图片要问多个问题」的场景:媒体上下文只预填充一次,单次调用最多携带 16 个问题并逐题返回结果。

关键数据:

核心思路是省掉对同一帧序列的重复前向计算:传统 Files API 只省上传,省不了每个问题的重复 prefill;Multilook 把一次 prefill 复用到全部问题上,成本节省在任何负载下成立,吞吐与延迟收益在系统繁忙时最明显。已有 API Key 与文档开放使用。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →