DeepSeekV4Flash正式版上线,没发布会没预告,API文档更新两个字"可用"就完事了。
模型结构没变,还是2840亿参数激活130亿,但重新做了后训练,Agent能力直接飞起。DeepSwe编程测试从7.3分暴涨到54.4分,性能翻了六倍多。整体性能已经超过GLM-5.2,比Opus 4.8差一点但不多。
更狠的是价格,输出百万token才2块钱,比降价后的GPT-5.6 Luna便宜一半。用十分之一的参数量做到前沿级性能,DeepSeek这波后训练确实封神了。
Pro正式版还要再等等,但光这个Flash已经够用了。

