Embedding 只用来做检索?作者盘点被浪费的隐藏能力
ProposalOrganic1043 · reddit · 2026-09-14
Reddit 一帖追问:既然 OpenAI 最初发布 embedding 模型时就声明其可原生支持搜索、聚类、推荐、异常检测、多样性度量与分类,为什么整个生态几乎全部押注在向量数据库和 RAG 上,并一路卷向 GraphRAG 和知识图谱,其他用法却始终没人捡起来?作者观察到一个矛盾:一边是「RAG 已死、向量库昂贵、ROI 不值」的抱怨满天飞,一边大家守着生产管线里已有的海量 embedding 却不挖掘更多价值。作者猜测检索之所以独大,可能因为搜索是最容易产品化、最容易围绕它做功能的场景,并想确认这是不是被低估的空白地带。讨论集中在为何非检索用法缺乏工具与最佳实践支撑。
「模型」频道最新
- 79K 参数小模型实测 RLT:能学状态追踪但长序列泛化差 — mike64_t · 2026-09-14
- 用户吐槽 Opus 写作:「编造术语」像轻度煤气灯 — julianharris · 2026-09-14
- Ollama 联合创始人:小模型已能胜任大多数对话与推理场景 — ollama · 2026-09-14
- 用户吐槽 GLM Flash 5.3 输出频繁滑回中文 — DevDminGod · 2026-09-14
- 让模型用 Python 代码作画,V4.1 Pro 展现惊人编程审美 — teortaxesTex · 2026-09-14
- 曝 OpenAI GPT-6 Sol 泄露输出击败 Astra,内部更强模型 Bell 未公开 — VraserX · 2026-09-14