GLM-5.3-Flash vs DeepSeek V4 Flash:缓存命中率与总成本

100 万输出 Token 为基准,当前假设:输入 : 输出 = 200 : 1
缓存命中率从 90.0%99.9%,步长严格为 0.1%。 命中率与输入输出比例均可用下方滑块实时调整。
精确交叉命中率
GLM 5折 ↔ DS低峰;GLM原价 ↔ DS高峰
低档交叉成本
每 100 万输出 Token
高档交叉成本
每 100 万输出 Token
96.0% 200 : 1
横轴刻度统一按百分比显示;理论交叉点由公式精确求解后单独标记,不改变 0.1% 的常规数据粒度。若当前输入输出比例下 90%~99.9% 区间内不存在交叉点(GLM 全程更便宜),则不标记。

完整数据表(0.1% 步长)

缓存命中率 GLM-5.3-Flash 5折 GLM-5.3-Flash 原价 DeepSeek V4 Flash 低峰 DeepSeek V4 Flash 高峰

计算公式

GLM 5折 = 200 × [h × 0.115 + (1 − h) × 0.4] + 1.4
GLM 原价 = 200 × [h × 0.23 + (1 − h) × 0.8] + 2.8
DeepSeek 低峰 = 200 × [h × 0.05 + (1 − h) × 1.5] + 4.5
DeepSeek 高峰 = 200 × [h × 0.10 + (1 − h) × 3.0] + 9.0
h 为缓存命中率(0~1)。所有价格单位均为人民币元 / 100 万 Token。 图表与表格由同一套公式实时计算,不做手工拟合。