单张RTX 3090跑27B模型15万上下文,DeepSeek harness实测惊艳
politefella0 · reddit · 2026-08-25
Reddit 用户分享 syv-ai/qwen38-27b-rtx3090 项目的实测体验:在单张 RTX 3090 上开启视觉能力、跑 150k 上下文,效果出色。他还让本地 Qwen 给 DeepSeek harness 写了个 Gmail 插件;不过写搜索引擎插件时把 dsh 搞崩了,harness 都启动不了。
一次运行的统计:26 轮对话、489 步,LLM 用时 161 分钟、工具调用 10 分钟,平均首 token 延迟 5.9 秒、86 tok/s,缓存命中率 0%,输入 35.7M token、输出 586K token。
「编程与Agent」频道最新
- 神经符号系统 SUCCESSOR Ω:生成并演化可执行世界程序 — Ghost_Pilot_MD · 2026-08-25
- 审计 AI 事实核查工具:18 次引用就有 1 次是编造的 — jonathancheckwise · 2026-08-25
- 教程:在树莓派上运行 Hermes Agent — LeviTurk · 2026-08-25
- 反对 Vibe Coding 观点:单人在 2026 年开发 MMO — TAbrodi · 2026-08-25
- Ox Alpha 模型单日将处理 6 万亿 tokens — AccBalanced · 2026-08-25
- JetBrains 本地 AI 选 Qwen3.6 27B 优化编程体验 — Danmoreng · 2026-08-25