跳到正文
原文
DeepSeek(@deepseek_ai)· DeepSeek (@deepseek_ai)·· 2026-09-10AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

DeepSeek V4.1-Flash 将 KV cache 的 HBM 需求降至上一代的 1/4

💾 Smaller KV cache. Bigger savings. Compared with the previous generation, V4.1-Flash’s KV cache n...

AI 导读

DeepSeek V4.1-Flash 相比上一代大幅压缩 KV cache,所需 HBM 仅为 1/4、SSD 存储仅为 1/8。缓存命中费用常占 AI 智能体成本的很大一部分,压缩缓存可显著降低这部分开销。

来源:DeepSeek(@deepseek_ai) · x.com