【DeepSeek V4.1 Flash 正式发布:性能超越旗舰,定价大幅下调】9月10日,DeepSeek 正式发布全新模型 V4.1 Flash。该模型采用 552B 参数的 MoE 架构与创新的 Causal-Encoder-Decoder 结构,输入激活仅 8B,输出激活 16B,具备原生多模态视觉理解能力。
基准测试中,V4.1 Flash 全面超越 DeepSeek V4 Pro 等旗舰模型,在 Terminal-Bench 2.1 达 90.6%,DeepSWE 达 74.2%,Automation-Bench 达 54.8%。同时,KV Cache 缓存效率大幅提升,对 HBM 需求减少至上一代的 1/4,SSD 需求减少至 1/8,显著降低 Agent 类任务成本。
API 定价同步下调,采用峰谷机制:闲时输入未命中缓存 1.0 元/百万 token、输出 4.0 元;高峰时段翻倍。腾讯 WorkBuddy、CodeBuddy 及 OpenCode 已全量接入。ai
