GLM-5.3-Flash和DeepSeek V4 Flash的价格放一起算了下。
按100M tokens请求量计算,其中98.7M缓存命中、1M未命中、0.3M输出,也就是绝大多数输入都能命中缓存。
GLM-5.3-Flash目前处于限时5折阶段,输入、缓存命中、输出均为原价5折。
100M tokens总成本约11.41元。
如果恢复原价,同样的请求量约22.83元。
再看DeepSeek V4 Flash:
空闲时段约7.79元;
高峰时段约15.57元。
也就是说,GLM-5.3-Flash即便打5折,成本依然比DeepSeek V4 Flash空闲时段高出约46%。
不过碰上DeepSeek高峰时段,GLM半价期间会便宜约27%。
等GLM恢复原价后,情况又会变化:22.83元对15.57元,即使拿DeepSeek最贵的高峰时段来比,GLM也要贵约47%。
现在大模型卷完能力、速度,Flash模型这边的价格战也越来越细了。
PS:计算过程汇率按7算。#DS #GLM
