2026年8月13日晚上,DeepSeek扔出一颗炸弹:API全面涨价,V4 Pro高峰时段输出从6元涨到27元/百万tokens,8月17日生效。
两天前,梁文锋刚完成一件事——重启第二轮融资,投前估值5000亿人民币(约710亿美元),计划再融500亿。据《财经》杂志报道,8月下旬完成签约。
两轮加起来,1000亿。
1000亿是什么概念?2026年一季度,整个中国AI赛道融资近600起,但DeepSeek、月之暗面、阶跃星辰三家加起来拿了930亿,占了全市场三成。DeepSeek一家,两个月融了别人一年的钱。
但融这么多钱,不是存银行吃利息的。大模型是这个星球上最烧钱的生意。训练一次V4 Pro,算力成本以亿计。上线后每天的推理成本,以千万计。
图1:DeepSeek创始人梁文锋(图源:网络)
现在,梁文锋开始算账了。
大模型的成本,拆开来看就三块:训练、推理、基础设施。
训练成本是大头,但一次性的。一个万亿参数级模型,训练一次大约1-3亿美元(7-21亿人民币)。V4 Pro的具体训练成本没有公开,但它每隔几个月就要迭代一次——4月V4预览版上线,7月V4-Flash上线,8月V4 Pro正式版上线。每次迭代,都是一笔新的训练账单。
真正让财务团队睡不着觉的,是推理成本。这是每天都在烧的钱。
DeepSeek日均处理多少tokens?官方没有公开。但据行业估算,头部大模型日均调用量在万亿tokens级别。按涨价前V4 Pro综合价格约9元/百万tokens计算,日均API收入大概90万元——这还是收入,不是利润。
图2:GPU服务器集群每天运转的电费和折旧,是大模型公司最大的持续成本(图源:网络)
然后是硬件。一个万卡H100集群,硬件投入25-30亿元,折旧周期3-5年,每年折旧6-10亿。电费更吓人:H100单卡功耗700瓦,万卡集群满载7000千瓦,加上散热和PUE,实际功耗约1.4万千瓦,一天电费约17万元。DeepSeek的GPU集群据信是数万卡级别,光电费每天可能就是几十万到上百万。
把GPU折旧、电费、人员工资、带宽、数据中心租赁加在一起,每天的运营成本在数百万级别。
API收入呢?涨价前综合价约9元/百万tokens,日均万亿tokens调用,收入90万/天。这还没算网页版和APP的免费用户——那些调用全是成本,一分钱收入没有。
算到这里,结论很清楚:涨价之前,DeepSeek的API业务大概率是亏的。每多一个用户,就多亏一份钱。
涨价公告里有一个被大多数人忽略的数字:缓存命中输入,从0.025元涨到0.3元,涨幅1100%。
先说清楚什么叫“缓存命中”。当多个用户问相似的问题,或者同一个用户重复问类似的问题,模型不需要重新计算,直接从缓存里读结果。这时候的边际成本几乎为零——服务器已经算过一次了,再读一遍缓存,几乎不花什么电费。
但就是这个“几乎零成本”的项目,涨了11倍。
图3:DeepSeek V4 Pro缓存命中价格从0.025元涨至0.3元,涨幅1100%(图源:网络)
这说明什么?说明DeepSeek涨价不是“成本推动型”,而是“价值定价型”。它不是在说“我成本涨了所以加价”,而是在说“你用我的缓存省了算力,我省下来的成本,你得分我一半”。
另一个细节:峰谷定价。高峰时段(9:00-12:00、14:00-18:00)全价,空闲时段半价。这和电价一个逻辑——不是成本不同(半夜GPU也在转),而是用价格调节需求。高峰期减少调用,避免GPU不够用;空闲时段降价,避免GPU闲置。
这是成熟的商业操作,不是“烧不动了被迫涨价”。DeepSeek在优化它的算力利用率和利润率。
摩根士丹利8月9日的研报也印证了这一点。报告显示,中国大模型API均价已从去年的12.2元涨至21.9元,行业正在从“价格战”转向“智力战”。DeepSeek不是唯一一家涨价的——智谱、腾讯混元、百度文心、阿里云都在上调推理算力价格。
这才是涨价的真正推手。
第一轮500亿,梁文锋个人掏了200亿,腾讯100亿,宁德时代50亿,京东、网易、IDG资本各30亿,国家人工智能产业投资基金10亿。融资落地后,梁文锋持股约84%,拥有100%经营表决权。外部投资人拿的是有限合伙份额,没有直接股权,没有投票权,股份锁定5年。
图4:DeepSeek两轮融资金额巨大,投资人需要看到回报(图源:网络)
500多亿砸进去,连个董事席位都换不来。投资人图什么?图回报。
大模型公司的商业化路径目前就三条:API收费、订阅制、To B解决方案。DeepSeek网页版免费,APP免费,To B业务刚起步。API是目前最直接、最快见钱的收入来源。
涨价前,DeepSeek API价格是全球最低之一。V4 Pro综合价格约9元/百万tokens,GPT-5.5的输出价格是它的11倍多。36氪5月份算过账:DeepSeek V4 Pro的平均执行成本约为GPT-5.5的十分之一。
但“比GPT便宜十倍”是抢市场的策略,不是长久生意。市场份额抢到了,开发者生态建起来了,接下来就是变现。
涨价后,V4 Pro高峰输出27元,仍然比GPT-5.5便宜很多,但利润率已经大幅改善。按缓存命中0.3元计算,这部分几乎是纯利。
更关键的是,第二轮融资正在进行。投资人看什么?看收入增速。涨价是向资本市场证明:DeepSeek不是只会烧钱,它也能赚钱。
融资节奏和涨价节奏完美吻合。这不是巧合。
DeepSeek涨价,最焦虑的是开发者。
一个用DeepSeek API做AI写作工具的创业者算了笔账:如果产品日均处理1000万字,涨价前每天API成本约90元,涨价后高峰时段约270元,一个月多花5000多元。对一个小团队来说,这不是小数目。
这些成本最终会传导到终端用户。你用的AI工具、AI客服、AI编程助手,迟早会涨价——或者减少免费额度。
但这未必是坏事。过去两年,大模型行业的“免费”和“白菜价”,本质是融资补贴下的畸形状态。一家公司可以亏一年、两年,但不可能永远亏下去。当补贴退潮,才知道谁在裸泳。
DeepSeek涨价350%,说明它对自己的产品有信心——开发者不会因为涨价就跑掉,因为V4 Pro的能力值这个价。正式版在Agent工作流、代码工程、工具调用等维度的基准测试中,已经接近Anthropic旗舰模型Claude Fable 5的水平。
图5:AI应用的未来,终究要回归商业本质(图源:网络)
梁文锋不是活雷锋,1000亿融资也不是做慈善。
从个人掏200亿启动首轮融资,到84%持股掌控绝对话语权,再到两个月后涨价350%——每一步都是算过的。他不是不懂烧钱,他只是比别人更清楚什么时候该停。
AI的免费午餐结束了。但接下来上桌的,可能才是真正的菜。