如果一个 AI 应用每天都要反复读取同一套说明书,新价格会让这部分成本明显下降。DeepSeek 公告称,Flash 系列将于 9 月 10 日 12 时调价:空闲时段每百万 Token——模型处理文字的计量单位——缓存命中输入价从 0.05 元降至 0.02 元,降幅 60%;未命中输入从 1.5 元降至 1 元,输出从 4.5 元降至 4 元。
缓存命中,是平台复用相同长前缀已经算过的中间结果,像保留一份做好的草稿,不必每次重算。新价下,空闲时段命中与未命中的价差达到 50 倍,对固定系统提示词多、上下文重复率高的应用尤其有利。工作日 9:00—12:00、14:00—18:00 仍算高峰,各项价格为空闲时段两倍。
这次调价紧跟 V4.1 Flash 中间版本内测,也延续了 DeepSeek 的峰谷计费思路。值得注意的是,最高六成降幅针对缓存命中输入,输出实际下降约 11%;最终能省多少,仍取决于应用的缓存命中率和输入输出比例。