已停更 4 个月的 Aider 为何仍霸榜 LLM 训练数据?开发者提出「数据污染」猜想
marlene_zw · x · 2026-09-23
开发者 marlenezw 观察到一个奇怪现象:每当询问开源 coding harness,Aider 总是排在推荐列表首位——但 Aider 的 GitHub 已 4 个月没有 commit,身边也几乎没人真在用。她猜测 Aider 之所以在模型回答中被高频提及,是因为它深度「 entrenched 」在 LLM 训练数据里(可能因大量教程、README 和 benchmark 语料),而非因为它仍是最佳工具。这引出一个值得注意的问题:模型推荐可能反映训练语料的曝光度,而非工具的真实现状。
所属事件:停更四个月的 Aider 仍霸榜 LLM 推荐,数据污染引猜想(3 条相关)→
「编程与Agent」频道最新
- 删掉三个 Agent 换 40 行 if 语句:延迟降 9 秒到 0.8 秒,成本省 75% — Prestigious_Style267 · 2026-09-23
- 开源 digital-twins:用无状态假服务测试触 Gmail/Slack 的 Agent — aofu_dev · 2026-09-23
- 别把脚本吹成 Agent:自动化与 Agentic AI 的界线到底在哪 — forevergeeks · 2026-09-23
- 用 DORA 指标衡量 AI 编程代理:从 PR 到合并的效率观察 — vincent_koc · 2026-09-23
- AI 浏览器 Strawberry 实测:把代理装进浏览器替代多标签协作 — damienghader · 2026-09-23
- Opus 5.5 实测:延迟与吞吐出色,重回编码主力 — rachittshah · 2026-09-23