DC娱乐网

LPDDR 取代 HBM - DeepSeek 4.1 Flash DeepSe

LPDDR 取代 HBM - DeepSeek 4.1 Flash
DeepSeek发布了 DeepSeek-V4.1-Flash!

> 552B 主干网络,在预填充时因果编码器-解码器仅激活 8B 参数,在解码时激活 16B 参数
> 通过稀疏查找访问 196B Engram 内存
> 通过有界重放,比 V4-Flash 减少约 8 倍的持久 KV

值得注意的[耶]

Engram 是许多中国实验室将采取的扩展新方向
- 美团的 LongCat 2 采用了它
- Qwen-3.8-Flash-Next 采用了它。

每个人都忽略的 DeepSeek 4.1 Flash 架构中最重要细节是,其近一半参数(Engram Embeddings)驻留在主机内存(LPDDR5)中,而不是 HBM。这节省了
- HBM 需求(非常昂贵)
- FLOPs 需求(预填充需要大量 FLOPs)。
模型主干参数(注意力、MoE)仍驻留在 HBM 上,但大多为 4 位。

通过 Engram,你用嵌入(可存储在主机内存中)来交换模型主干参数数量(需要 HBM)。结果模型具有相当或更好的性能。DeepSeek 在他们 2026 年 1 月的论文中首次谈及了

DeepSeek 将大力采用这种方法,因为他们/华为 HBM 短缺,而中国其他实验室跟随 DeepSeek 的引领。所以这是意料之中的事。

DeepSeek