众力资讯网

DeepSeekV4.1 Flash虽然叫Flash,但它是552B+196B

DeepSeekV4.1 Flash虽然叫Flash,但它是552B+196B Engram总参数量其实比当年V3的671B还要大,Engram技术前段时间的Qwen3.8 Flash Next也用了,跑分同样优异。打个不怎么恰当的比方就是以前模型是闭卷考试,复习的时候啥知识点都得记在脑子呢,现在允许模型带参考书进考场,开卷考试脑子就不用记完整的知识点,复习压力就小很多了,做题效率嘎嘎快,得分嘎嘎高。今年的模型新架构应该都要用上这个技术,以后就是大查表时代了。