众力资讯网

DeepSeek于9月10日12:00起正式下调Flash系列模型API定价,闲时输入缓存命中价格从每百万token 0.05元降至0.02元,降幅达60%;缓存未命中输入从1.5元降至1元,输出从4.5元降至4元。高峰时段(工作日9:00-12:00、14:00-18:00)为闲时价格的2倍,其余时段均按闲时计费。 与此同时,V4.1 Flash中间版本已 ​

DeepSeek于9月10日12:00起正式下调Flash系列模型API定价,闲时输入缓存命中价格从每百万token 0.05元降至0.02元,降幅达60%;缓存未命中输入从1.5元降至1元,输出从4.5元降至4元。高峰时段(工作日9:00-12:00、14:00-18:00)为闲时价格的2倍,其余时段均按闲时计费。

与此同时,V4.1 Flash中间版本已同步开启内测,开发者无需更改base_url,将模型名切换为「deepseek-v4.1-flash-expires-on-0910」即可调用,单账号最多支持20并发请求,内测期间计费与V4 Flash相同。该版本采用全新模型架构,原生支持多模态视觉理解,不再依赖"外挂式"视觉编码器,出厂即具备图文一体化输入输出能力。内测阶段重点验证能力上限、生成速度和推理成本三项指标,模型ID中的失效日期为9月10日,属于短期测试版本,尚未替换官网API文档中的正式V4 Flash型号。

从策略来看,降价和内测同步推进,信号很明确:用更低的价格吸引开发者跑通工作流,用V4.1 Flash的原生多模态能力拓展使用场景,最终目标是让Flash从"便宜替代品"升级为大多数任务的默认调用模型。涨价不到一个月DeepSeek又要降价了