求助:寻找原生支持64k上下文的本地 GGUF 模型

Inner-End7733 · reddit · 2026-07-31

一位开发者在尝试将 Hermes Agent 完全本地化部署到低配设备(64GB 内存 + RTX 3060)时遇到了上下文瓶颈。

面临问题:

需求:

寻找一个原生支持 64k+ 上下文、非推理型、且已有 GGUF 量化版本的密集模型,以满足本地 Agent 工作流的硬性要求。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →