4090 跑 Qwen 提速到 70-90 tok/s,开发者晒本地 AI 编码工作流
julianharris · x · 2026-09-20
开发者 julianharris 分享其高速运转的本地 AI 编码环境,关键信息:
- 调优成果:找到一个设置让 4090 + Qwen 27B 的输出从 50-70 tok/s 提升到持续 70-90 tok/s,约为 Claude Opus 吞吐量的 2 倍
- 工具组合:使用极简 agent harness Pi 搭配 MCP 扩展,接入自己的 spec 管理与治理系统(Ceetrix)
- 实战案例:Qwen 找出一个 bug,孤立看似乎需要大规模重写,但通过 Ceetrix 的任务上下文发现功能其实已实现——只是藏在菜单而非按钮里,问题实为糟糕的设计
- Pi 简介:支持 skills、AGENTS.md、四种运行模式(交互/print/RPC/SDK),可通过扩展、包自定义工作流,作者强调「改 harness 适配你的工作流,而不是反过来」
「编程与Agent」频道最新
- px0 编辑器更新:git 状态流式推送,SSE 只查 3 个文件实现零轮询 — arpit_bhayani · 2026-09-20
- Google 自研面向 Agent 工作负载的开源编排器,重造有状态 Kubernetes — gaganghotra_ · 2026-09-20
- 吴恩达发布 1 小时智能体知识图谱免费课程 — irinarish · 2026-09-20
- 作者称 NoSpoon 智能体全自主生成内容,一条微短剧约 15 分钟完成 — Kyrannio · 2026-09-20
- 开源 Laya 移植 MLX:13ms 本地决策,零 token 玩贪吃蛇 — JiliJeanlouis · 2026-09-20
- NoSpoon 微短剧 agent 接入 Grok Imagine,一键生成剧集海报 — Kyrannio · 2026-09-20