ORIGINAL STORY

DeepSeek发布调价公告:最新API价格怎么看,开发者该如何核算成本

“DeepSeek发布调价公告”登上抖音热点榜。本文依据DeepSeek官方定价页面梳理V4系列API的缓存命中、缓存未命中及输出价格,说明普通用户是否受影响,并提供企业和开发者重新估算账单、核对渠道价格与控制成本的实用方法。

开发者在电脑前结合计算器和成本趋势图分析AI模型API费用
开发者在电脑前结合计算器和成本趋势图分析AI模型API费用
本文目录

“DeepSeek发布调价公告”登上抖音热点榜后,不少读者首先想知道:到底调整了什么,普通聊天会不会收费,开发者的账单又会发生多大变化?从目前可以核验的DeepSeek官方定价页面看,价格所指向的主要是开放平台API调用,计费对象是通过接口把模型接入软件、网站、智能客服或内部工具的开发者与企业,并不能直接等同于网页端、App端向普通用户收费。

截至2026年8月14日,DeepSeek官方价格页列出的模型为deepseek-v4-flash和deepseek-v4-pro。两者均按百万tokens计价,但缓存命中输入、缓存未命中输入和模型输出采用不同单价。由于价格页面可能继续更新,实际扣费仍应以开放平台控制台、账单和官方最新页面为准。

当前官方价格表包含哪些关键信息

按照DeepSeek官方定价页面当前展示,deepseek-v4-flash每百万tokens的缓存命中输入价格为0.02元,缓存未命中输入为1元,输出为2元;deepseek-v4-pro对应价格分别为0.025元、3元和6元。

  • V4-Flash:适合更看重响应效率和调用成本的通用场景,缓存命中输入0.02元/百万tokens,缓存未命中输入1元/百万tokens,输出2元/百万tokens。
  • V4-Pro:面向对模型能力要求更高的任务,缓存命中输入0.025元/百万tokens,缓存未命中输入3元/百万tokens,输出6元/百万tokens。

官方页面还显示,两款模型的上下文长度为1M,最大输出长度为384K;并发限制分别为V4-Flash 2500、V4-Pro 500。并发量描述的是同一时间尚未完成的请求数量,不是每天只能调用多少次。

桌面上的三组计数圆片分别模拟缓存输入、普通输入和模型输出的计费流向
桌面上的三组计数圆片分别模拟缓存输入、普通输入和模型输出的计费流向

为什么同样是输入,价格会分成两档

理解这次价格信息,关键在于弄清“缓存命中”。API请求常常包含重复内容,例如固定的系统提示词、反复使用的知识库前缀以及多轮对话历史。如果一段输入满足平台的缓存命中条件,系统可以复用已有结果,计算成本较低,因此其单价远低于缓存未命中的输入。

但低廉的缓存价格并不意味着每个输入token都能按该档结算。提示词前缀变化、上下文排列改变或缓存策略不匹配,都可能导致未命中。开发者不能简单地用最低单价乘以全部输入量,而应分别统计缓存命中输入、未命中输入和输出。

一个不依赖具体业务的计算方法

月度费用可以拆成三部分:缓存命中输入量乘以对应单价,加上缓存未命中输入量乘以对应单价,再加上输出量乘以输出单价。由于官方价格单位是“每百万tokens”,计算时还要先将各项token数量除以一百万。

例如,某项业务缓存命中率很高,成本下降可能十分明显;如果提示词频繁变化、每次都附带不同的长文档,则账单仍可能主要由未命中输入和输出构成。判断影响时应看实际用量结构,不能只看公告中最醒目的最低价格。这与阅读油价调整何时生效、加满一箱能省多少类似:公布的单位价格变化,必须结合个人用量才能换算成真实支出。

普通网页端和App用户会受影响吗

API调价主要影响调用开放平台接口的账户。普通用户直接使用官方网页或App时,是否收费、有哪些功能限制,应以相应产品页面显示的规则为准,不能把API每百万tokens的单价套到一次普通对话上。

同样需要区分的是,第三方平台提供的DeepSeek模型服务不一定执行原厂直连价格。云平台可能加入服务费、峰谷价格、套餐折扣、并发保障或运维支持;使用开源模型自行部署,则要承担服务器、显卡、电力、带宽和维护成本。看到“同款模型”时,仍要确认服务商、模型版本和计费渠道。

企业和开发者现在应做什么

  1. 确认模型名称。检查代码和控制台中实际调用的是V4-Flash还是V4-Pro,同时留意旧模型别名及版本迁移安排。
  2. 导出真实用量。分别统计缓存命中输入、未命中输入、输出和失败重试,不要只看请求次数。
  3. 重新计算预算。至少按日常流量、高峰流量和异常重试三种情形测算,给月度预算留出合理余量。
  4. 核对生效渠道。原厂开放平台、云服务商和聚合平台的价格可能不同,应以签约渠道的公告及账单为准。
  5. 设置费用告警。为单日支出、单用户用量、输出长度和重试次数设置阈值,避免程序错误造成意外消耗。
软件团队对照抽象用量图表复核AI模型调用成本
软件团队对照抽象用量图表复核AI模型调用成本

不要为了省钱直接切换模型

价格只是选型指标之一。切换模型前,最好用自身业务样本比较答案正确率、工具调用稳定性、延迟、输出长度和人工复核成本。如果便宜的模型导致重试增加或需要更多人工修正,总成本未必更低。涉及合同审核、代码修改和关键业务决策时,还应保留人工复核机制。

企业评估价格变化时,也要区分“单价下降”和“员工实际收益”等不同概念。正如最低工资标准上调会影响哪些收入需要结合适用范围判断,API调价是否带来明显节省,也取决于模型、渠道、缓存命中率和业务调用量。

如何判断后续消息是否可靠

面对社交平台上的截图或转述,建议依次核对公告主体、模型全名、计价单位、生效时间、适用渠道和是否属于限时优惠。尤其要防止把“每千tokens”与“每百万tokens”、人民币与美元、原厂API与第三方托管价格混在一起比较。

可靠的成本判断应同时回答四个问题:谁在调价、哪款模型调价、何时生效、自己的请求结构是否适用。

“DeepSeek发布调价公告”受到关注,反映出大模型价格已经成为开发者选型的重要变量。但真正决定账单的不是一个最低数字,而是缓存利用率、输出规模、并发需求和调用渠道。对普通用户而言,不必把API价格变化直接理解为聊天产品收费变化;对开发者而言,最有效的应对则是及时导出账单、按真实用量重算成本,并持续查看官方定价页面。

版权声明:本文由“热词说”编辑原创撰写,未经授权请勿转载。撰写日期:2026年8月14日。