前文基础模型 Bash 能力已超人类,专用工具可删
_philschmid · x · 2026-09-01
Philipp Schmid 分享了一个实测结论:编码 agent 越来越倾向用 Bash 完成传统上由 read/edit/search 等专用工具负责的任务。
他每隔几个月就从零重写一次 agent harness,以观察哪些东西该删。这次他把所有面向模型的工具都删掉,只留 Bash 和一个媒体查看器。结果是任务完成率保持在同一水平,agent 在更少工具边界下完成复杂工作和验证。
他认为前沿模型在狭义上已「超人类」:能在几秒内合成一次性的命令行程序,而多数开发者拼装同样的程序需要长得多的时间。
「编程与Agent」频道最新
- Signal65 报告:杂乱数据致 AI 代理完成率降 28% — ryanshrout · 2026-09-01
- 用 Opus 定制框架替换 Next.js,JS 体积缩减 99% — maxleiter · 2026-09-01
- 解析 Grok Bot 与传统编码工具的架构差异 — altryne · 2026-09-01
- 推荐用于服务器代理管理的工具 Herdr — HarveenChadha · 2026-09-01
- Shopify 分享 LLM 生产环境持续优化飞轮方法论 — MParakhin · 2026-09-01
- 开源 MCP 工具:自动提取测试套件并强制 Agent 重构遗留代码 — Left-Yellow1047 · 2026-09-01