Agentic infra 可能胜过单模型
prasanna_says · x · 2026-07-21
这条转发在讨论 agentic infra 的价值:真正决定效果的,往往不是单独的 LLM,而是 LLM + harness/编排层 之后的整体系统。
核心观点是 组合泛化:模型即使会解题 A,也不一定能把结构相似的未见题 B 解出来。通过上下文卸载、程序化子调用等手段,harness 可以把两个表面不同的问题“对齐”为同一类结构,从而让模型更容易从简单任务泛化到更难任务。
作者还认为,这种方法不仅适用于编程、数学这类有闭环的领域,也可能扩展到其他可分解任务;在一些场景里,当前由人类承担的“闭环”其实就是在用审美和筛选来选出更好的 agent 输出。
所属事件:AI Agent 架构反思:harness 变薄与单多智能体权衡(13 条相关)→
「编程与Agent」频道最新
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11