Ling Tiny 速度实测:4060Ti 上的超快辅助模型
Badger-Purple · reddit · 2026-08-23
作者分享实测体验,表示 Ling Tiny 已取代 Gemma4-12B,在 4060Ti 显卡上作为执行后视操作的辅助模型,速度极其惊艳。
配置提示:不要启用 MTP,使用为 BailingMoE3 修改的 vLLM fork 版本。
「模型」频道最新
- 实测 DeepSeek 极低量化版:2.52 位精度表现惊人 — nomorebuttsplz · 2026-08-24
- NVIDIA 应用深度学习研究 VP 将上播客,谈专用教师模型与 Nemotron — arena · 2026-08-24
- OpenRouter 神秘模型 Ox Alpha 被疑为 GLM 5.3 Flash,或反超顶级模型 — TheZachMueller · 2026-08-24
- Qwen 3.8 27B 模型在 Agent 任务中自主调用视觉 QA — awitod · 2026-08-24
- 实测:Grok 4.6 胜任常规工作,难处理复杂任务 — latticecut · 2026-08-24
- 求助:本地运行 Krea2 Turbo 出现随机视觉伪影 — Different_Ad_7508 · 2026-08-24