Back to News

DeepSeek cuts V4-Flash API prices up to 60%, effective Sept 10

#deepseek#api-pricing#price-cut#v4-flash

DeepSeek announced a price cut for its V4-Flash series API, with off-peak rates dropping up to 60% compared to the August 17 peak-period pricing. The new prices take effect at 12:00 Beijing time on September 10, with peak hours defined as Monday to Friday 9:00–12:00 and 14:00–18:00. The company also began internal testing of a V4.1 Flash intermediate model, named deepseek-v4.1-flash-expires-on-0910, with the same billing as V4 Flash.

Coverage timeline

  1. 机器之心机器之心

    本周二晚间,DeepSeek 开放平台发布公告,计划再次调整大模型 API 定价,这次是喜闻乐见的降价。 闲时价格统一为:输入(缓存命中)0.02 元、输入(缓存未命中)1 元、输出 4 元(单位均为元 / 百万 token)。高峰时段价格仍为空闲时段的两倍,即缓存命中 0.04 元、缓存未命中 2 元、输出 8 元。 本次调整只涉及 V4-Flash 系列,定位更高的 V4-Pro 价格维持不变。新价格将在北京时间 9 月 10 日 12:00 生效。 官方同时明确,高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余为空闲时段。 此前,DeepSeek 的涨价引发了人们的广泛讨论。官方给出的解释是为了更合理地调配资源,鼓励用户调整任务执行时间。外界则普遍认为是 DeepSeek V4 Flash 0731 性价比很高,吸引了全球用户的大量调用,以及 DeepSeek 缺乏足够算力。 纵向对比一下,8 月 17 日零时涨价前,Flash 是统一价 0.02 元(缓存命中)/ 1 元(未命中)/ 2 元(输出)。把这次的新价格摆进去: 也就是说,输入侧的两项价格回到了涨价前,输出仍是涨价前的两倍。若按高峰时段算差距则更大:新高峰价 0.04 / 2 / 8 元,对比涨价前的 0.02 / 1 / 2 元,分别是 2 倍、2 倍和 4 倍。 因此,用户能否真正回到过去「放开了用」的状态,取决于自身应用的三个变量:缓存命中率、输入输出比例、以及任务可错峰的程度。对长上下文、固定系统提示词、Agent 循环调用这类缓存命中率高的场景,降幅会很明显;对以生成输出为主的场景,感受有限。众所周知 DeepSeek API 的缓存命中率是比较高的,所以目前大家给出的反应比较乐观。 本次降价并非孤立事件,昨天下午,DeepSeek 在官方交流群宣布 V4.1 Flash 中间版本开启内测 :模型名为 deepseek-v4.1-flash-expires-on-0910,base_url 不变,每账号限流 20 并发,计费暂与 V4 Flash 相同。 新模型除了原生多模态、极快的推理速度之外,官方还表示通过架构的升级让成本更低。可见通过大模型本身的工程与技术优化,DeepSeek 一直在尝试改进推理成本的问题。 expires-on-0910 这个模型