众力资讯网

大佬zartbot发了篇深度分析博文《DeepSeek-V4.1 Flash 把

大佬zartbot发了篇深度分析博文《DeepSeek-V4.1 Flash 把 KV Cache 压缩推到极致》地址:zartbot.github.io/blog/model_arch/dsv41flash_arch/index.html

这是对DeepSeek-V4.1的系列解析文章第一篇,重点介绍DeepSeek-V4.1 是怎么把 KV Cache 压缩推到极致的。

“DeepSeek-V4.1 Flash 发布的时候, 觉得可能就是一个后训练迭代的版本... 但是用了一下发现差不多接近 420 Tokens/s 的速度, 然后崔老师又说要下架所有的 DeepSeek-V4 Pro 的模型... 突然就觉得这事情不简单了...直到完全公开 Technical Report 《DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression》才意识到它应该叫 DeepSeek-V5 Flash...”