DeepSeek近日宣布对旗下flash系列模型进行新一轮价格调整,自2026年9月10日12:00起正式实施。此次调价延续了峰谷分时计费模式,但进一步优化了价格结构,其中输入缓存命中价格最高降幅达60%,成为开发者关注的焦点。
根据调整方案,空闲时段(非高峰时段)每百万Token的定价为:输入缓存命中0.02元、输入缓存未命中1元、输出4元;高峰时段价格则为空闲时段的2倍,即缓存命中0.04元、缓存未命中2元、输出8元。高峰时段明确划定为北京时间周一至周五的9:00-12:00和14:00-18:00,其余时间均按空闲时段计费。与旧价相比,空闲时段输入缓存命中价格从0.05元降至0.02元,降幅60%;输入缓存未命中价格从1.5元降至1元,降幅33.33%;输出价格从4.5元降至4元,降幅11.11%。高峰时段价格也同步下调,缓存命中从0.1元降至0.04元,缓存未命中从3元降至2元,输出从9元降至8元。
此次调价策略进一步拉大了闲时与峰时的价格差距,为开发者提供了更灵活的成本优化空间。例如,夜间或周末执行批量任务时,若缓存命中率较高且输入输出Token结构合理,综合调用成本有望降低约40%。业内人士指出,"错峰使用+充分利用缓存"将成为当前使用flash系列模型最具性价比的方式。
值得注意的是,这已是DeepSeek近期第二次调整价格。8月23日,平台曾优化峰谷计费规则,将周六、周日全天统一执行低谷价,不再区分峰谷时段;更早的8月17日,DeepSeek还对V4系列模型完成了一轮峰谷定价调整,当时高峰价格曾大幅上调。有分析认为,此次降价与新一代模型研发节奏密切相关——9月8日,DeepSeek已启动v4.1 flash中间版本的内测,官方称其性能更强、速度更快且成本更低,此次调价可视为对8月涨价的部分回调,同时也为新模型的竞争力提升铺路。
目前,DeepSeek Flash系列包含deepseek-v4-flash与deepseek-v4-flash-vision-exp两款模型,此次调价标准对两者均适用。





