开发者实验:把模型历史评测数据注入上下文让 agent 自知水平
AaronBergman18 · x · 2026-10-07
- 开发者 AaronBergman 分享一个 vibecoded、未经验证的实验:把 benchmark 结果和历史模型的 benchmark 数据注入编码 agent 的上下文窗口,让 agent 知道自己能力如何。
- 通过一行 curl ... | bash 命令即可安装。
- 作者自述不确定是否真的有效,属于快速实验分享。
「编程与Agent」频道最新
- Ofir Press:AI 编码还没到「纳维-斯托克斯级」,但正在路上 — OfirPress · 2026-10-07
- 开发者:编码 agent 离全面普及还差冗余输出和真长上下文 — A_K_Nain · 2026-10-07
- 提示词工程少即是多:除非有 eval 证明,否则一律做减法 — andreisavu · 2026-10-07
- vLLM 开源 Vela 2.0 路由模型:0.3B-9B 四种规格 — vllm_project · 2026-10-07
- 多租户 RAG 为何挡不住越权:检索层 ACL 实现 80 万次金丝雀检测零泄露 — Acceptable_Army_6472 · 2026-10-07
- Grok Build 迎来史上最大更新,agent 全栈可靠性大改 — elonmusk · 2026-10-07