本地模型视觉追踪仅 3Hz,距实时智能体还有一年?
yacineMTB · x · 2026-09-08
Sentdex 引用 LearnOpenCV 的实测指出:用 GPT-6 Astra Ultra 追踪网球的完整工作流耗时 11 分 49 秒、共消耗约 787 万 tokens(含 752 万缓存输入),单靠 3 个并行 agent 标注球体就花了 8 分 35 秒。他估计当前本地模型(GLM 5.3 Flash、Qwen Next Flash、DSV4F-vision 等)做追踪+推理只能达到约 3Hz,距离以 10-30Hz、低于 200ms 延迟运行「Astra 级」智能体大约还差一年。核心启示:视觉智能体的瓶颈不在单帧智力,而在推理延迟与上下文 token 成本。
「模型」频道最新
- Spark-X2.5-4B GGUF 量化版登上 Hugging Face 热门 — XHToken · 2026-09-08
- Grok、Claude、ChatGPT 齐变「说教脸」,用户抱怨模型越来越爱纠错 — ionicfellow · 2026-09-08
- 开发者盘点 AI 竞赛格局:Fable 5.1 与 Astra 并列第一 — bindureddy · 2026-09-08
- Reddit 用户吐槽 Claude 回答变啰嗦:ChatGPT 现在更好用? — thermonuclear_icbm · 2026-09-08
- 实测称 Astra 浏览器操作能力不错,速度仍偏慢 — jobergum · 2026-09-08
- Codex 实用技巧:让 Astra 读取剩余额度百分比,用英语设预算跑长任务 — Dimillian · 2026-09-08