12GB 显存跑 Krea2 GGUF,1024 图最快 11 秒生成
Symphony_of_Heat · reddit · 2026-09-24
作者分享了本地文生图工作流:用 Krea2turbo-Q4-CR.gguf 配合 Qwen3VL-4B-Instruct(视觉)和 dolphin3.0-qwen2.5:0.5b(LLM)优化提示词,在 RTX 4080 笔记本 GPU(12GB 显存)上生成 1024x1024 图像:新提示词约 14 秒,同提示词约 11 秒。工作流文件已通过 pastebin 分享。
「Infra」频道最新
- Modal 拟以约 150 亿美元估值融资,Baseten 洽谈估值达 260 亿 — nmasc_ · 2026-09-24
- Fireworks 发布 Ember-1:基于 Kimi K3,推理 token 省 40% 质量持平 — sophiamyang · 2026-09-24
- NVIDIA BioNeMo 让蛋白质结构预测吞吐提升 2.9 倍 — AllThingsApx · 2026-09-24
- Liquid AI 发布 DSpark 投机解码,LFM2.5-VL-3B 解码提速至 3 倍 — helloiamleonie · 2026-09-24
- Stripe 发布欧洲创业与算力数据:AI 企业支付额、数据中心容量对比 — jeff_weinstein · 2026-09-24
- 单张 RTX 5090 实测:MiniMax H3 视频生成的各种加速方法 — fruesome · 2026-09-24