0.57MB 路由模型降本68%

Negaaaa7 · reddit · 2026-07-20

作者称自己用 Prompt Compass 把 LLM 成本降低了 68%。这是一个只有 0.57 MB 的小模型,能够在一次约 5 ms 的 CPU 调用里完成四类判断。

它做什么

它把原本常常拆成多模型、多次网络往返的流程合并到一起:

结果数据

局限

集成方式

项目提供:

作者还说明:扩展只是托管 API 的薄客户端;真正本地运行的是 SDK。它不能拦截 Copilot/Cursor 内置聊天。扩展同时也上了 Open VSX,并提供免费档。

所属事件:仅0.57MB的本地路由器大幅削减LLM成本(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →