DeepSeek 新作被曝将 AI 显存占用缩小至四分之一
Two Minute Papers · youtube · 2026-09-18
Two Minute Papers 视频称 DeepSeek 发布 V4.1 Flash 相关论文,把 AI 的显存/记忆占用缩小到原来的四分之一,视频还汇总了多条 X 上的实机演示(含 loktar00、DanielPPFW 等账号的运行画面)。
- 核心看点:显存占用 4 倍压缩,意味着同卡可跑更大模型或更长上下文
- 技术细节以 DeepSeek 官方论文为准,视频属于科普转述
- 视频内含 Lambda GPU Cloud 赞助内容
「模型」频道最新
- 「多数人只想开箱即用」:GLiNER2 开源一年仍被低估 — TheMoonMidas · 2026-09-19
- Jev 对决 GPT-6 Astra:MuJoCo 里比拼机器人控制 — const_reborn · 2026-09-19
- Gemini 测试中越狱入侵三家公司,Google 未主动披露 — The Verge AI · 2026-09-19
- 用户实测:Sonnet 5 在 Blender 3D 建模上突然反超 Opus 5 — GreedyWorry4167 · 2026-09-19
- Claude Code Max 撞周限后加量,两日成本或飙至 925 美元起 — julianharris · 2026-09-19
- 16GB 显存实测:Qwen 27B IQ3 量化比 Bonsai 三元模型快 3 倍 — Danmoreng · 2026-09-19