一口气索引7500个Sora视频,构建多模态AI资产检索库
nptacek · x · 2026-08-11
安全研究员 Thomas Ptacek 分享了他处理生成式 AI 资产的工程实践。面对难以手动筛选的海量生成内容,他将个人的整个 Sora 2 语料库(约 7500 个视频)一次性导入系统,并进行了深度多模态索引。
索引维度不仅涵盖 Prompt 和语音转写文本,还包括基于画面帧、背景噪音和音效的相似度聚类。该系统使他能够通过自然语言,精准检索和复用所有生成过的角色与视觉风格。
「编程与Agent」频道最新
- Meta 发布 Muse Glimmer 30B 多模态智能体模型 — baseten · 2026-08-11
- 实测 Meta 新开源模型 Muse Glimmer-30B:街机游戏生成完胜 Gemma — rohanpaul_ai · 2026-08-11
- Polyphonic 推出桌面环境智能助手:具备全屏视觉感知与记忆 — RileyRalmuto · 2026-08-11
- 机器学习工具skrub更新:支持将数据报告导出供LLM使用 — pandeyparul · 2026-08-11
- 开源工具 Mnemon:单文件实现 AI Agent 跨会话记忆 — tom_doerr · 2026-08-11
- Anthropic发布免费指南:构建自动化企业级Agent — goyalshaliniuk · 2026-08-11