用 6 年前的 CLIP 做零标注图搜:2.5 万图检索小于 50ms
jason_mayes · x · 2026-09-22
xenovacom 演示了一个快到可以媲美最新多模态模型的老方案:
- 用的不是新模型,而是近 6 年前发布的零样本多模态分类器 CLIP。
- 效果:2.5 万张图片的语义搜索不到 50ms,且无需人工标注图片。
- 部署:基于 Transformers.js,可在浏览器里用 WebGPU 本地运行,作者提供了在线 demo 可直接试用。
展示了经典模型在本地轻量图像检索场景依然非常能打。
「多模态」频道最新
- 用 Sentinel 可视化人类运动轨迹,效果惊艳 — Kyrannio · 2026-09-22
- 用户实测新版 Pika:质量漂亮,老牌玩家重回赛场 — Kyrannio · 2026-09-22
- 腾讯混元图像 3.5 登陆 OnSolo:5 张参考图 2K 输出仅 1 积分 — Div_pradeep · 2026-09-22
- AI 生图「博物馆雕像被调包」梗图走红,作者附上 prompt — umesh_ai · 2026-09-22
- 普林斯顿 VideoGen-Agent:多任务智能体 RL 调工具,视频生成提 19 分 — princetonu · 2026-09-22
- Intel 为 Qwen-Image-2.1 提供首日 OpenVINO 优化支持 — Alibaba_Qwen · 2026-09-22