DeepSeek今日正式发布DeepSeek V4.1 Flash,这是全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。
经内部及多方外部测试,V4.1 Flash在性能、响应速度、计算费用及总处理用时等核心指标上均全面超越此前的V4 Pro模型。
V4.1 Flash已上线DeepSeek开放平台,开发者将模型名称改为deepseek-flash即可调用,旧模型名deepseek-v4-flash和deepseek-v4-flash-vision-exp暂时路由到新模型。
V4.1 Flash为552B参数的MoE模型,输入激活仅8B、输出激活16B,成本显著低于已知同尺寸模型。采用创新的causal-encoder-decoder结构,输入输出不对称设计;配合新预训练方式与更大规模强化学习后训练,基准测试智能水平超越V4 Pro等旗舰模型。KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。
自9月10日12时起Flash系列调价,空闲时段输入缓存命中降至0.02元/百万Token、未命中1元、输出4元,其中缓存命中输入价格降幅高达60%。延续峰谷分时计价,高峰时段(周一至周五9:00-12:00、14:00-18:00)价格为空闲时段两倍。
2026年9月14日12:00之后至V4.1 Pro上线前,所有deepseek-v4-pro请求将全部路由至V4.1 Flash并按新单价计费。
热点跨界共创老张聊科技