8月17日起,DeepSeek V4-Pro的API调用价格迎来结构性调整:高峰时段输出价格上调至27元/百万tokens,命中缓存的输入价格回调至0.30元/百万tokens。而在今年5月,这家公司才刚刚宣布V4-Pro永久降价75%,缓存命中价低至0.025元/百万tokens。从“梁圣”变“梁子”,梁文锋只用了一个季度。

希鸥网观察到,这绝非一次简单的涨价:2026年8月海外评测机构Artificial Analysis显示,DeepSeek V4-Flash智能指数约53分,单任务成本仅0.25美元;而智能指数63分的Claude Opus 5(max)单任务成本高达2.34美元。一边是极致性价比,一边逆势涨价,DeepSeek的定价逻辑,正在从“低价换规模”切换到“用价格筛客户”。

直接原因是成本压不住了。AI服务器核心组件HBM3E单价从2024年的约520美元涨至2026年的约1200美元,DDR5颗粒同期从3美元涨到38美元,涨幅超十倍。中国日均token消耗从2024年初的约1000亿飙升至2026年的140万亿级别,而高端GPU产能被英伟达锁死、电力机房的扩建周期长达2到4年,任何供应商都难以靠技术手段压住指数级上涨的硬成本。

涨价还是一场精准的客户筛选。那些把业务建立在DeepSeek超低价API之上的套壳应用、低毛利创业公司,一夜之间成本结构失效。但8月13日静默上线的V4-Pro正式版跑分追平海外旗舰,涨价后27元/百万tokens的价格仍是海外旗舰的十几分之一。OpenRouter数据进一步显示,V4-Flash在8月初单周调用量已达8.83万亿tokens,盘子大到服务不过来,调价自然成了分流的工具。

当“低价换规模”进入下半场,“价格即产品”的逻辑开始浮出水面——AI服务的价格分层,本质上是技术能力的分层。英伟达GPU昂贵、DeepSeek性价比版本便宜,都是技术能力的货币化表达。梁文锋的那句“AI的普惠性,应该建立在成本结构的可持续性上”,或许是对这次涨价最好的注脚。对开发者而言,涨价的DeepSeek依然是最具性价比的底座,但蜜月期结束了。

希鸥网认为,DeepSeek用一次教科书式的逆势涨价,把AI行业的竞争从“比谁亏得起”拉回了“比谁算得过账”。技术领先的“大厨”敢于在基础款上低价甚至免费吸引流量,但在面对满汉全席级别的任务时,稀缺性和算力消耗必然推动价格翻倍上涨。这也宣告了一个事实:以烧钱换市场、以亏损换份额的AI上半场,正式终结。

创业者需要清醒认识到,涨价不是市场失灵,而是市场在重新定价。那些把自己绑定在单一低价供应商身上的应用层公司,正在经历一次强制压力测试。达利欧在《原则》中反复强调,拥抱现实、有效应对现实,才是进化的起点——固守“大模型就该永远便宜”的幻想,就像期盼现实与真实情况不同,最终只会被现实淘汰。

把涨价视为一种产品设计,而非单纯的商业决策,是头部玩家给创业者的第二课。达利欧提出的五步进化流程——设定目标、直面问题、诊断根源、规划方案、执行到底,恰好对应AI创业者的定价策略:在模型架构阶段就要思考推理成本,在Agent调用爆发前就要设计缓存策略,而不是等技术成熟后才贴上一个“价签”。价格从来不是产品的附属品,价格本身就是产品的一部分。

这轮涨价还给所有创业者提供了一个冷静的样本:当成本结构被上游锁死,当价格优势被规模稀释,保持头脑极度开放、随时准备调整认知模型,才是唯一的护城河。正如达利欧所言,大多数人无法进化,是因为固守自己的错误观点。从“降价换份额”到“涨价筛客户”,DeepSeek完成了一次决策模型的迭代。那些跟不上这个节奏的对手,恐怕接不住这一招。

金鸥品牌榜·2026年度创新案例库开放申报了。免费提报,独立评估,入榜品牌将获得电子版《入榜证明》及年度专题公示,优秀案例可获得深度专访+全平台分发。 如需修改或发布文章,请加微信号:sheisceo