DeepSeek准备涨价:最值得看的, 不是 Token 贵了,而是 AI 价格战开始换规则
灵活不僵硬阿起
编辑于 2026年08月07日 23:00
聊聊人工智能

(全文约4800字,阅读需要13分钟左右)

一句话讲清楚:2026 年 8 月 6 日,DeepSeek 开放平台提示,计划近期整体上调 API 服务定价,并明确称“预计涨幅较大”;截至 8 月 7 日,新的具体价格和生效时间仍未公布。此前 DeepSeek 已引入高峰时段翻倍的峰谷计费。它仍然是市场上极具价格竞争力的模型服务,但“长期用超低价换开发者”的阶段,正在出现明显变化。

一、消息本身:DeepSeek这次说了什么?

8 月 6 日,DeepSeek 开放平台页面出现了一条很短、但信息量很大的提示:公司计划近期整体上调 DeepSeek API 服务定价,预计涨幅较大,并提醒开发者合理安排使用。北京商报与 21 财经均报道了这条开放平台通知。最关键的一点是——DeepSeek 还没有公布完整的新价格表,也没有给出明确的生效日期。

所以现在能确认的只有“要涨、而且官方预告幅度不会小”;至于 V4-Flash、V4-Pro 分别涨多少,高峰价是否继续按倍数叠加,甚至 C 端网页和 App 是否会跟进收费,目前都不能提前下结论。

在这一轮预告之前,DeepSeek 已经走过了几次相当反差的价格动作:4 月 V4 Preview 上线;5 月原本限时的 V4-Pro 低价被保留下来;6 月又公布峰谷计费机制,高峰时段价格翻倍;到了 8 月 6 日,则进一步预告“整体上调”。

过去几个月,DeepSeek 的定价轨迹:

真正值得关注的,不是 DeepSeek 从“便宜”突然变成“贵”,而是它开始主动测试:开发者愿意为能力、稳定性和可用算力多付多少钱。

二、DeepSeek 的账:从“价格屠夫”到“卖生产力” 

要理解 DeepSeek 为什么敢涨,先看它现在卖的到底是什么。早期大模型 API 更像一种“体验券”:开发者先接进来、先试起来,模型厂商通过低价获得生态和调用量。价格本身就是获客工具。

但 Agent 把这门生意改了。聊天机器人里,一个用户问一句、模型答一句,成本大致随着用户操作增长;Agent 则会自己规划、自己调用工具、自己反思和重试。一项任务在后台可能触发几十轮甚至更多模型调用。对用户来说只是“帮我做完这件事”,对模型服务商来说却是持续流动的 Token 和持续占用的 GPU。

这也解释了为什么 DeepSeek 先做峰谷计费。此前披露的高峰时段为北京时间 9:00-12:00、14:00-18:00,V4-Pro 的缓存未命中输入从 3 元/百万 Token 提到 6 元,输出从 6 元提到 12 元。这个动作与其说是在“赚一倍”,不如说更像云计算、电力系统常见的容量定价:最稀缺的不是平均算力,而是大家同时来用时那一截峰值算力。

Agent 时代,模型厂商卖的已经不只是“每百万 Token 的计算”,而是“在你最需要的时候,能不能稳定给出足够多的智能”。

更有意思的是,DeepSeek 并不能简单被归类为“低价亏损,所以被迫涨价”。2025 年,DeepSeek 曾披露过一组理论推理经济数据:按当时公开价和满负载估算,单日理论收入明显高于推理成本;但公司同时强调,真实收入要低得多,因为网页和 App 免费、存在优惠时段,也不是所有调用都按满价计费。那组数据的价值不在于证明 DeepSeek 有多赚钱,而在于提醒我们:价格策略、容量利用率和实际变现之间,并不是一条简单的成本加成公式。

三、开发者的账:最先消失的,可能是“靠便宜 Token 吃差价”

对于普通用户,这次最直接的影响暂时还不是“聊天要收费了”。截至目前,官方没有宣布 C 端产品同步涨价。真正需要立刻重算账的,是把 DeepSeek API 当作底层生产资料的开发者和企业。

假设一个 AI 产品过去的商业模式很简单:每个用户每月付 20 元,后台平均消耗 5 元模型费用,剩下的空间覆盖服务器、渠道和利润。只要底层 Token 价格足够便宜,这个模型就能跑起来。但 Agent 的调用量天然更不稳定:复杂任务会循环、工具失败会重试、长上下文会反复传入。底层 API 一旦整体涨价,再叠加高峰时段倍价,原本看起来宽松的毛利很容易突然变薄。

这会逼着应用团队把“模型成本优化”从财务表格搬进产品架构:能缓存的前缀就缓存,能用 Flash 的任务不要全丢给 Pro,非实时任务尽量错峰,简单分类和抽取交给小模型,真正困难的推理再调用强模型;再往前一步,就是多模型路由、私有化部署和开源模型作为议价与容灾选项。

过去做 AI 应用,模型选型常常是“哪个强用哪个”;接下来更像云计算:哪个任务、什么时延、什么质量、什么价格,要一起算。

这对只靠“套一个模型 API”做产品的团队不是好消息,但对真正有工作流、数据、用户场景和工程能力的团队反而是一次筛选。Token 不再无限便宜后,谁能用更少的调用完成同样的任务,谁就真正拥有产品效率。

四、最反直觉的信号:成本还在降,价格却可以涨

很多人看到涨价,会自然推导出一个结论:是不是大模型算不动了、成本压不下去了?这个推导并不完整。

就在 6 月底,NVIDIA 还公开宣称,其推理软件栈在 Blackwell 平台上针对 DeepSeek V4 的 token 成本,一个月内最多下降了 5 倍。需要强调,这是 NVIDIA 自己的工程口径,不能直接等同于 DeepSeek 的实际成本;但它至少说明一件事:推理效率仍然在快速进步,“单位计算成本下降”与“API 市场价格上涨”完全可以同时发生。

为什么?因为商品价格从来不只由成本决定。当模型从“好玩的工具”变成能写代码、跑流程、做客服、做研究的生产力后,客户开始为结果、稳定性、吞吐和省下的人力买单。此时厂商更可能从“成本定价”走向“价值定价”:不是问一百万 Token 花了多少电,而是问这一百万 Token 帮客户完成了多少工作。

如果连最擅长把 Token 做便宜的 DeepSeek 都开始试探更高价格,真正的行业信号不是“AI 变贵了”,而是“智能开始有了更明确的定价权”。

五、我的 4 点判断

第一,低价战争没有结束,但它正在分层。 未来更可能出现“两头走”:基础任务、小模型、可替代能力继续降价;真正能做复杂 Agent、长上下文和高可靠推理的模型,则更有条件维持溢价。把这次 DeepSeek 调价理解成“所有 Token 从此越来越贵”同样过头。

第二,DeepSeek 正在测试自己的定价权。 过去用户选择它,一个重要原因是“能力够强、价格低得离谱”。如果整体涨价后调用量仍然稳、开发者也不大规模迁走,DeepSeek 的品牌就会从“最便宜的强模型”进一步变成“值得付费的生产力基础设施”。这比一次涨价本身更重要。

第三,应用公司的核心能力会从 Prompt Engineering 继续向 Cost Engineering 迁移。 缓存命中率、模型路由、上下文裁剪、任务拆分、异步调度、失败重试策略,以前是优化项,接下来会越来越像利润表的一部分。谁把这些做得更好,谁就能在同样的模型价格下做出更便宜、更稳定的产品。

第四,不用着急把涨价自动解读成“新模型马上发布”或“DeepSeek 算力告急”。 目前公开通知只确认了整体涨价计划,并没有给出新价格、生效日期,也没有把调价与某个新模型发布直接绑定。算力需求、商业化、服务稳定性都可能是因素,但在正式公告出来前,最稳妥的做法是把“事实”和“猜测”分开。

结语

过去一年,大模型行业最让人兴奋的一件事,是 Token 价格不断往下掉:能力越来越强,调用越来越便宜,开发者像突然拿到了一种几乎不要钱的新生产资料。DeepSeek 又把这件事推到了极致。

现在它开始举起涨价牌,反而说明 AI 正在进入下一个阶段。便宜仍然重要,但不再是唯一变量。真正值钱的开始变成:高峰期能不能稳定调用,Agent 能不能长时间工作,模型能不能少走弯路,以及一百万 Token 最终能替你完成多少真实任务。

所以,等正式价格表出来时,我们当然应该算清楚每百万 Token 贵了多少。但更值得盯住的是另一张表:同样一块钱,AI 到底替我们多做了多少事。

AI 的下一轮竞争,可能不再是谁把 Token 卖得最便宜,而是谁能证明:自己的 Token 最值钱。

参考信源

[1] DeepSeek API Docs,模型 & 价格(近期页面) https://api-docs.deepseek.com/zh-cn/quick_start/pricing

[2] 21财经,2026-08-07,《DeepSeek预告API涨价,AI低价红利落幕》 https://m.21jingji.com/article/20260807/herald/10ac18e0ab73de1dbadba766561e702f.html

[3] 北京商报/中华网,2026-08-07,《DeepSeek举起涨价牌》 https://finance.china.com/TMT/13004688/20260807/49660299.html

[4] 澎湃新闻,2026-06-29,《DeepSeek V4正式版7月中旬上线,高峰时段API价格翻倍》 https://www.thepaper.cn/newsDetail_forward_33478426

[5] Reuters,2025-03-01,DeepSeek披露理论推理成本与收入估算 https://www.reuters.com/technology/chinas-deepseek-claims-theoretical-cost-profit-ratio-545-per-day-2025-03-01/

[6] NVIDIA Blog,2026-06-30,《How NVIDIA’s Inference Software Stack Powers the Lowest Token Cost》 https://blogs.nvidia.com/blog/inference-software-lowest-token-cost/

发布说明:本文以 2026 年 8 月 7 日可核验公开信息为准。DeepSeek 新一轮 API 调价的具体价格与生效时间尚未正式公布,因此文中不预设涨幅;高峰翻倍计费按此前公开披露口径表述。NVIDIA 的推理成本下降数据为厂商自报工程口径,不等同于 DeepSeek 实际运营成本。文中关于“定价权、行业阶段、Agent 需求”的内容属于基于公开事实的分析判断。

关注公众号,不定期更新AI热点深度分析

如果你也在关注AI与科技产业的变化,欢迎一起持续观察。

少一点短期噪音,多一点深度学习。

共同进步,掌握最新科技情况,摆脱AI焦虑。

本文写于2026年8月7日晚