开源应用 Modly 用 llama.cpp 做本地 3D 建模智能体
Lightnig125 · reddit · 2026-10-06
开源桌面应用 Modly v0.4.3 把 llama.cpp 设为默认 agent 引擎:用户输入提示词或图片即可用纯本地模型生成 3D 网格,还带一个能操作整个应用的聊天智能体。
工程实现:
- 每个加载的模型跑一个 llama-server 进程,仅监听 localhost;可同时加载多个模型,默认数量按 VRAM 计算,空闲模型自动卸载,给 3D 生成腾显存。
- 智能体是标准 OpenAI 风格 tool-calling 循环,工具包括读取网格信息、简化(decimate)、平滑、创建/运行工作流、从显存卸载模型等。
- 模型库直接吃 GGUF 文件,显示大小、量化等级和预估显存占用,并对每个模型的工具调用能力打分(区分实测与据公开 benchmark 估测)。
实测:RTX 3060 12GB 上用 Qwen 3.5 4B(Q4KM) 把 260 万三角形网格降到 30 万,模型正确调用 decimatemesh 并汇报结果,模型已加载时约 9 秒,首次调用约 40 秒(需加载权重)。
坦承局限:4B 小模型有时会编造结果——某次简化未达标(UV 接缝限制)却胡编理由,作者考虑把工具输出更明确地回喂;多步工作流创建可靠性明显低于单次工具调用。其他 OpenAI 兼容后端仍可选。作者询问大家 8B 以下哪个模型工具调用最可靠,自己目前最满意 Qwen 3/3.5 4B。
「编程与Agent」频道最新
- 开发者实测:Google Docs/Drive 比 Markdown 文件更适合同步 Agent 上下文 — AI_Andrew · 2026-10-06
- Cursor SDK 子智能体可向主进程回传结果,还开放替换系统提示词 — tetsuoai · 2026-10-06
- Grok Bot 官宣两周六场工作坊,覆盖营销、销售与编程场景 — XFreeze · 2026-10-06
- Nous Research 发 Agent 宣言:模型、记忆、运行环境都该由用户掌控 — NousResearch · 2026-10-06
- Linux 上完整安装 Google Antigravity 套件的教程 — CommunicationMean385 · 2026-10-06
- 实测20余种让廉价编码模型变强的方法:强模型「良心监督」性价比最高 — KangarooAnxious9394 · 2026-10-06