别只用向量检索:grep 与整库塞长上下文是被低估的 Agent 找上下文模式
jakedahn · x · 2026-09-25
作者梳理了 agent 检索上下文的三种思路:
- Embeddings 聚类:用有趣内容簇的中心点作为粗筛代理来找相似内容,但在某些场景下噪声大、易误导。
- Agent 直接 grep:让 agent 在磁盘上反复 grep 文件直到满意,再把内容作为下一轮上下文。作者实测效果很好,且感觉更接近程序员无 agent 时的自然工作方式。
- 整库拼接进长上下文:把整个语料 cat 成一堵文字墙,直接丢进超长上下文窗口,用 prompt 问「修复这个 bug 需要什么上下文」「找出有趣性」「找出偶然复杂度/本质复杂度」。其中「本质复杂度」一问可作为从糟糕代码中发现/提取刚性 API 与接口的良好代理。
作者指出全用 LLM/agent 做这类事成本高,而 jev 这类模型让人能在这个层面快速廉价地「冲浪」。
「编程与Agent」频道最新
- 用户实锤 Codex 定额消耗异常:任务一夜吃掉 $200 套餐 30% — sethlazar · 2026-09-25
- SaaS 框架实测继续:gregmushen 晒图称一键生成应用「似乎跑通了」 — gregmushen · 2026-09-25
- Claude Code 用户热推 /claude-api prompt-audit 优化 Opus 5.5 配置 — JeremyNguyenPhD · 2026-09-25
- Claude Opus 5.5 复刻 Splatoon 可玩 demo,游戏全由 AI 生成 — Angaisb_ · 2026-09-25
- 开发者用 Jev 决策模型打造框架无关的 Agent 工具路由器 — Huzeyfe_dev · 2026-09-25
- API 字段改名是最危险的破坏性变更,CI 里 diff 规格才能兜住 — Franc0Fernand0 · 2026-09-25