Gemma 26B A4B 本地实测:一次过 C++ 编码测试,工具调用却频翻车
HyperWinX · reddit · 2026-09-20
用户在本地用 llama-server 跑 Unsloth 的 Gemma 26B A4B QAT Q4KXL 量化模型(搭配 Q40 MTP 投机解码、128K 上下文),发现它成为其测试集中首个一次性通过 C++ HTTP 服务器编写任务的小模型,5 分钟完成且实测可用。但在 Pi agent 中做工具调用时问题频出:提交计划失败、写文件时混淆或遗漏参数,上下文到约 30K 后愈发严重,且输出重复多。帖中附完整 llama-server 启动参数,并询问如何提升工具调用成功率。
「编程与Agent」频道最新
- 读不懂 AI 写的代码,vibe coding 只做黑盒测试隐患几何 — Ryan_yii · 2026-09-20
- 自建项目频繁崩坏,vibe coder 求完整工作流避坑指南 — Ryan_yii · 2026-09-20
- 让编码 Agent 自测后端 API:开源 CLI 打包失败现场供其自我修复 — KARYTON618 · 2026-09-20
- OpenEnv 开源项目活跃:社区贡献基建适配、MCP 与 WebSocket 修复 — ben_burtenshaw · 2026-09-20
- mitsuhiko 谈智能体编程的共同挫败感:它比看起来更难 — mitsuhiko · 2026-09-20
- 阿拉伯语圈最全 Codex 桌面版教程:从安装到 MCP 实战 55 分钟讲透 — aziz4ai · 2026-09-20