单张RTX 3090跑27B模型15万上下文,DeepSeek harness实测惊艳

politefella0 · reddit · 2026-08-25

Reddit 用户分享 syv-ai/qwen38-27b-rtx3090 项目的实测体验:在单张 RTX 3090 上开启视觉能力、跑 150k 上下文,效果出色。他还让本地 Qwen 给 DeepSeek harness 写了个 Gmail 插件;不过写搜索引擎插件时把 dsh 搞崩了,harness 都启动不了。

一次运行的统计:26 轮对话、489 步,LLM 用时 161 分钟、工具调用 10 分钟,平均首 token 延迟 5.9 秒、86 tok/s,缓存命中率 0%,输入 35.7M token、输出 586K token。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →