众力资讯网

deepseekv4flash 王者归来!

DeepSeek 发布 V4.1-Flash:新架构最小模型,性能全面超越 V4-Pro

DeepSeek 推出 V4.1-Flash 模型,作为新架构家族最小成员,具备原生视觉理解能力,采用 552B 参数 MoE 及不对称 Causal Encoder–Decoder 设计,输入仅 8B 活跃参数。

新架构显著压缩 KV cache,仅需前代 1/4 HBM 和 1/8 SSD 存储,同时通过预训练与大规模 RL 后训练,在 Terminal-Bench、DeepSWE、CyberGym 等基准上领先 V4-Pro 等旗舰模型。

模型已在 DeepSeek API 上线支持多模态,API 价格降低,并计划开源权重与推理支持,合作伙伴 WorkBuddy_AI 和 opencode 已集成。
#发布cny测试 #AI反常识howto #howto用AI抢救一切