Qwen3-Coder 30B本地跑进GitHub Copilot,96GB显存下每秒85 tokens
ollama · x · 2026-08-13
开发者burkeholland在GitHub Copilot应用中通过Ollama本地运行Qwen3-Coder 30B模型,在96GB VRAM上达到约85 tokens/秒的生成速度。虽然不及Sol,但进展可观。
「编程与Agent」频道最新
- 绕过扫描限制:开源工具 gdown 实现 Google Drive 批量下载 — tom_doerr · 2026-08-13
- 开发者提议打造开源AI工作区,90%收入分给创作者 — EagleApprehensive · 2026-08-13
- 戒断几周后重蹈覆辙:开发者再试 Claude 编程助手破防 — carsonfarmer · 2026-08-13
- 基于 Nemotron 3.5 微调,Juno-N-Coder-25B 发布 — NVIDIAAI · 2026-08-13
- 智能体开发反思:瓶颈不在模型而在“需求规格说明书” — Zachly · 2026-08-13
- 用 Codex 自动生成 Mac 快捷指令,打造个性化工作流 — billyjhowell · 2026-08-13