实测:大模型做大脑+本地小模型打工,这套架构的瓶颈在哪?

InterviewDesigner777 · reddit · 2026-07-31

一位开发者在 Reddit 发起讨论,质疑目前流行的“大模型 API 做编排器 + 本地中小模型做执行器”架构的实际收益。作者目前使用托管的大模型作为架构师,本地运行 Qwen-class 27B 模型负责代码扫描、重构和测试,虽然可行,但他怀疑算上网络延迟和上下文读取成本,实际收益被高估了。

作者呼吁社区分享真实的基准测试数据,特别是以下几个维度的实测表现:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →