文章摘要
DeepSeek将于北京时间2026年9月10日12时起,调整旗下Flash系列大模型的调用定价,本次调整覆盖闲时场景服务,其中闲时缓存单价降幅达60%,为本次优惠幅度最大的项目,同时调整了闲时输入、输出单价,高峰时段价格为闲时的2倍;此外DeepSeek v4.1 flash已正式开放调用,明确了接入方式、计费规则与并发限制。

据行业观察,DeepSeek将于北京时间2026年9月10日12:00起,对旗下flash系列大模型的调用定价进行大幅调整,计价标准为每百万token的消费金额。

本次调整覆盖闲时场景下的三项核心服务:

  • 闲时输入单价从1.5元/百万token下调至1元/百万token
  • 闲时输出单价从4.5元/百万token下调至4元/百万token
  • 闲时缓存单价从0.05元/百万token下调至0.02元/百万token

高峰时段的调用价格为闲时时段价格的2倍

本次调整中,闲时缓存价格降幅达到60%,是本次调价中优惠幅度最大的服务项。

此外,DeepSeek v4.1 flash模型目前已正式开放调用。调用该模型时无需修改base_url,仅需将模型名称设置为deepseek-v4.1-flash-expires-on-0910即可正常接入。该模型的计费规则与deepseek-v4-flash保持一致,单账号最高支持20并发调用请求。

请留意,本次调整的所有相关数据均以官方最终发布的信息为准。

以上内容不代表本平台立场,仅供读者参考