实测本地模型:Qwen-27B 替代云端,Ornith-9B 也能写代码
Barni275 · reddit · 2026-08-31
一位开发者分享了本地运行开源模型进行编码的实战体验:
- Qwen-2.5-72B (文中笔误为 27B/3.8):在 RTX 3090 (Q80 KV, 18w context) 上运行,Prefill 约 1000-1500 tps,生成 45-60 tps。体验极佳,已替代 5-6 个月前的云端订阅方案处理主要编码任务。
- Ornith-1.5-9B:在 8GB 显存的家庭服务器上运行。虽然未跑基准测试,但在简单的 Python 重构任务中表现成功。作者询问社区是否有更多该模型的真实编码反馈。
「编程与Agent」频道最新
- 开源 CommerceAgentBench,Qwen 跃居开源模型榜首 — Alibaba_Qwen · 2026-09-01
- 实测发现:Agent 查“此人是谁”几乎全死路 — Dry_Steak30 · 2026-09-01
- 整合 Posthog 与 Notion,Agent 自动化用户访谈与反馈闭环 — lennysan · 2026-09-01
- 用 Grok Bot 构建大学录取数据集清洗流 — lennysan · 2026-09-01
- 构想 Grok Bot 钱款漏洞猎人应用 — lennysan · 2026-09-01
- 从 Discord 机器人到多人共享 Agent 工作区:团队工作流升级记 — steipete · 2026-09-01