曝 DeepSeek V4.1 Flash 配 196B 参数查询表 Engram,查表代替计算
cephaloform · x · 2026-09-11
据 plotarmordev 的消息(未证实),DeepSeek V4.1 Flash 配备约 200GB 的查找表,官方称之为 Engram:在 552B 主模型旁放置 196B 参数的存储条目。
工作原理:模型不把所有东西都算出来,而是把最后几个 token 转换成地址,像查索引一样拉取匹配的行。每个 token 只读取少量行,因此这张表不需要昂贵的 GPU 显存。转发者感叹,相比 llama「transformer++」多年来的渐进式改动,这类设计简直像外星科技。
所属事件:爆料称 DeepSeek V4.1 Flash 实为 718B 稀疏模型(2 条相关)→
「模型」频道最新
- 爆料称 Kimi 曾用 Claude 原始思维链蒸馏,网友讽其山寨 Claude — xuanalogue · 2026-09-11
- 用户切回 GPT-5.6:省用量且体感更快 — CtrlAltDwayne · 2026-09-11
- 开发者观点:好的封装下模型差异很小,Grok 4.6 够用 — gnukeith · 2026-09-11
- DeepSeek-V4.1-Flash 登陆 Ollama:763B MoE、1M 上下文,主打 KV cache 压缩 — ollama · 2026-09-11
- Anthropic 发布最详细威胁情报报告,曝 Claude 遭滥用案例 — typewriters · 2026-09-11
- 多智能体 eval 形态未定,colocated 异步 RL 训练正成趋势 — stochasticchasm · 2026-09-11