Ninfer 跑 Qwen 3.8 27B:采样参数还要不要手动配?
Hekel1989 · reddit · 2026-08-17
用户从 llama.cpp 迁移到 Ninfer 在 RTX 4090 上本地运行 Qwen 3.8 27B,推理性能大幅领先,但找不到 temperature、top-p、top-k 等采样参数的配置入口,发帖求证:现代模型是否只需调 thinking effort 而无需手动调采样参数(以及如何在 opencode 里设置)。这反映了新推理引擎把采样策略内置化、用户只需控制思考力度的趋势。
「Infra」频道最新
- LTX-2.5 对比 MiniMax H3:32GB 5090 上的 i2v 实测 — chanteuse_blondinett · 2026-08-17
- GitHub 宕机:网页及 API 错误率超 20% — jonathan_wilke · 2026-08-17
- 在经典机上为量子计算造 AI,如同用帆船技术设计喷气机 — AryHHAry · 2026-08-17
- 收购 OpenRouter,Stripe 布局机器支付基础设施 — 0xSammy · 2026-08-17
- PyTorchCon 北美站 10 月举行,推理专场聚焦低延迟服务 — PyTorch · 2026-08-17
- 调查:亚马逊为AI训练购书扫描后销毁,珍本遭毁 — james_mtc · 2026-08-17