模型变强≠可删封装层:反方观点称复杂 agent 外壳仍在烧 token
max_paperclips · x · 2026-09-30
maxpaperclips 反驳 housecor 的流行观点(模型进步会让开发者加在 agentic 编码工具上的 skills、自定义循环、MCP、记忆系统等复杂封装层变得多余甚至有害)。他认为这种说法并不属实:模型变好并不会突然学会记忆重复任务、感知自己可用的 API,或自动积累可复用工具集。实际变化只是 prompt 和指令可以写得更简略;那些嵌套循环、任务进度追踪等工程结构仍不可省,不会因为模型在 TerminalBench 上提 2% 就消失。
「编程与Agent」频道最新
- Midas Touch 代码数据集遭质询:可复现性与数据泄漏存疑 — maier_ak · 2026-09-30
- Midas Touch:直接从源码扩展 AI 编码环境的新论文 — maier_ak · 2026-09-30
- DevDay 三个被忽视的信号:插件分发窗口、Codex 安全、Decisions API — dhruv2038 · 2026-09-30
- 6 个 LLM PK 97 格标注数据:漏提取的锅在 ASR 不在模型 — Sufficient_Flower860 · 2026-09-30
- 开发者让 LLM 记录执行顺序,破解 Minecraft 世界生成非确定性难题 — gandamu_ml · 2026-09-30
- CaptchaArena:5 万道交互式验证码训练集,9B 模型 Pass@1 达 71.7% — ColumbiaUniversity · 2026-09-30