2026年8月17日零时,DeepSeek正式实施新一轮API调价:旗舰模型DeepSeek-v4-pro高峰时段每百万tokens输出价格升至27元,较调价前上涨约350%,并同步引入峰谷定价机制。这是国产大模型领域迄今幅度最大的一次商业定价调整,信号意味浓厚——当AI Agent驱动的Token消耗指数级膨胀,算力供需缺口持续扩大,国产大模型正在告别纯粹的价格内卷。
此轮调价并非孤立事件。就在同一周,商汤科技预告2026年上半年将录得约5亿至7亿元盈利,这是其上市以来首次实现合并盈利;英伟达Spectrum-X以太网硅光交换机全面量产,国产超节点同步进入放量元年。算力经济从”抢份额”切换到”要回报”的逻辑,正在产业上下游同步发酵。

调价背后的供需缺口
理解这轮涨价,先看算力供给侧的刚性约束。2026年第二季度,北美四大云厂商合计资本开支超过1700亿美元,全年指引上修至约7450亿美元;腾讯单季资本开支达528亿元,同比增长176%,接近2025年全年水平的三分之二。即便如此,算力供给仍追不上Agent应用的爆发式消耗。
需求端的增长更为迅猛。Agent驱动的多轮推理、长任务执行让单次请求消耗的Token数量呈数量级跃升。中信证券研报预计,”十五五”时期我国新增智能算力有望达到约3000万P,全口径资本开支达10万亿元量级。当推理需求远超算力扩张速度,头部模型厂商率先用价格杠杆调节供需,是商业上必然的选择。
峰谷定价机制的引入同样值得关注。将高峰时段的token成本上浮、低谷时段让利,本质是把算力的电力成本结构显性化,引导开发者在非高峰时段调度批量任务。这与数据中心”削峰填谷”的运营逻辑一脉相承,也意味着国产大模型开始像水电一样精细化运营资源。

从价格战到价值战的拐点
过去两年,国产大模型厂商用一轮又一轮的降价抢占开发者心智,DeepSeek、阿里、字节都曾把推理价格打到每百万tokens几毛钱甚至更低。低价策略换来了生态规模的快速扩张,但也让头部厂商陷入”增收不增利”的尴尬。如今DeepSeek敢把旗舰模型价格上调三倍,底气来自两个层面。
其一,模型能力形成了差异化壁垒。DeepSeek-v4-pro在复杂推理、Coding与Agent能力上显著强化,Artificial Analysis Intelligence Index得分53分,高于V4-Flash的40分,高难度任务场景几乎没有平价替代品。其二,企业客户对”稳定输出+长程执行”的付费意愿在提升——当模型从聊天工具变成生产力引擎,成本敏感度反而下降。
可以预见,涨价不会只是DeepSeek一家的动作。模型能力分层的趋势下,”顶级模型高价、通用模型低价”的价格矩阵将成为国产大模型的新常态,开发者与企业的选型逻辑也将从”谁便宜”转向”谁的单位Token产出价值更高”。

算力基础设施的新叙事
价格信号向上游传导,算力基础设施正在经历从”堆规模”到”提效率”的转变。英伟达8月14日宣布Spectrum-X以太网硅光交换机全面量产,定义为全球首款量产的200G/lane CPO以太网交换机系统,光损耗由约22dB降至约4dB,信号完整性实现64倍提升,单芯片带宽翻倍至102.4Tb/s。
国产算力同样在加速追赶。腾讯云披露将于2026年第四季度部署NPO(近封装光学)超级节点,阿里云3.2T NPO系统计划年底启动小批量部署、2027年规模化。超节点通过Scale-up高速互联将数十至上千张GPU封装为统一算力单元,直接缓解单卡算力不足与互联延迟瓶颈。当推理成本成为商业模式的核心变量,谁能把单位算力的产出效率做到极致,谁就能在下一轮竞争中掌握定价权。
DeepSeek的这次调价,表面是一张价格表的变化,背后却是国产AI产业从”圈地”走向”变现”的集体转身。当模型、算力、资本三者的回报逻辑重新对齐,中国AI产业的商业化叙事,才刚刚翻开新的一页。




