Glean 分层路由小模型组合,节省 81% Token 成本

企业搜索公司 Glean 分享其“智识适型”策略:不盲目追求最强模型,而是根据任务难度将请求分层路由到不同模型。实测显示,相比直接使用 Claude Coworker,该方案节省了 81% 的 Token 成本。Glean 认为,随着模型能力趋同,企业 AI 的核心瓶颈已从原始算力转向对“组织上下文”的理解,需通过整合公司知识、模型、智能体与工作流,确保任务获得正确信息与执行路径。

2026-08-26 ~ 2026-08-26 · 2 条相关