Twelve Labs 发布面向视频检索、记忆和智能体的技术栈
qdrant_engine · x · 2026-07-29
Twelve Labs 认为,视频不能简单当成“逐帧图片”或“带时间戳的转录文本”,因为运动、因果和时间推进本身就是信息。James Le 在 Vector Space Day SF 上指出,视频系统常见三类失败:上下文错误、记忆错误、推理错误;并介绍了对应的技术栈:Marengo 负责视频检索,Pegasus 负责把检索到的片段转成结构化答案,Jockey 作为面向视频语料工作流的 agentic framework 和记忆层,底层由 Qdrant 提供存储与检索。
「编程与Agent」频道最新
- 一位开发者说,模型第一次比他更快定位 bug 根因 — MaziyarPanahi · 2026-07-29
- NewMax 把 Grok 接进多智能体工作流,开始出海 — huangyun_122 · 2026-07-29
- 借鉴古法:新框架解决多智能体链「静默失败」 — alizahidrajaa · 2026-07-29
- ISNAD把多智能体链路可信度做到claim级别 — alizahidrajaa · 2026-07-29
- Claude Code 32k 提示词让人更偏爱 1k 的 agent harness — pauliusztin · 2026-07-29
- 多渠道 AI 回复栈被 Twilio 每月 120 美元短信费卡住 — Cuncirps · 2026-07-29