DeepSeek V4 Flash Vision 亮相,305B 权重本地部署门槛极高
No_Issue_8224 · reddit · 2026-09-04
DeepSeek 发布 DeepSeek-V4-Flash-Vision-Exp 视觉实验模型,补齐了此前缺少视觉能力的短板。作者通过 ZenMux API 实测,图像识别表现出色(非正式测试)。难点在硬件:权重达 305B,官方 vLLM 方案需要单节点 4 张 GB300,远超个人桌面配置。作者分析:对全天处理图像、需要稳定延迟的团队,一次性购机可能划算;但周末项目会让昂贵显卡长期闲置,并持续产生电力、散热与维护成本。
「Infra」频道最新
- fal h3 视频生成成本还需降 100 倍:每小时 22 美元远超手游人均 0.24 美元 — IndraVahan · 2026-09-04
- Apple M5 Ultra 512GB 版可本地跑 97 个开源模型中的 93 个 — bigaiguy · 2026-09-04
- Guillaume Verdon 调侃 Astra 跑在 Cerebras 上如开 400kph 布加迪 — beffjezos · 2026-09-04
- Paddock 开源:自研 CUDA kernel 的推理引擎,13 项对比全胜 vLLM — saltexx · 2026-09-04
- Tim Sweeney:游戏业正遭遇 1980 年代以来最严重崩盘 — tekbog · 2026-09-04
- Transformers.js 播客预告:浏览器内跑抠图与转写 — nicodotdev · 2026-09-04