DeepSeek于8月6日通过开发者后台弹窗公告,计划近期整体上调API服务定价,"预计涨幅较大,请合理安排您的使用",具体方案以正式通知为准。公告称此次调整为API服务整体提价,不区分平峰与高峰时段。截至目前,DeepSeek未公布新的价格数字或涨幅百分比。
这一转向发生在其主力模型调用量急剧攀升之后。DeepSeek V4-Flash于7月31日正式上线公测,在OpenRouter周榜(7月27日至8月2日)上以7.22万亿Token调用量登顶全球第一。开源编程平台OpenCode数据显示,8月1日单日即处理了8万亿Token,其中5万亿来自免费调用、3万亿来自付费。8月4日,V4-Flash API因"前所未有的访问量"出现容量不足,部分时段返回429错误并使性能下降,DeepSeek官方状态页确认了这一情况。
涨价前,DeepSeek维持了业内最低的API单价。V4-Flash平峰时段输入(缓存命中)仅0.02元/百万Token,输出2元/百万Token;即便在高峰时段翻倍后,输入也仅为0.04元至2元,输出4元。V4-Pro平峰输入3元、输出6元。与此对照,OpenAI于7月30日宣布GPT-5.6 Luna降价80%,输入降至0.20美元/百万Token、输出降至1.20美元/百万Token,距离7月9日发布仅隔21天。Meta于8月5日推出Muse Spark 1.2的API服务,定价为输入1.25美元、输出4.25美元。阿里巴巴Qwen3.8-Max的国内API为输入12元、输出36元。DeepSeek凭借高达98%的缓存命中折扣,实际单任务成本仍大幅低于竞品。
此次涨价并非孤立事件。智谱AI在2026年一季度累计提价83%,调用量反而增长400%,呈现量价齐升。智谱CEO张鹏表示,长期依赖低价竞争不利于行业发展。阿里云、腾讯云和百度智能云年初已集体上调AI算力相关价格。硅基流动平台自8月3日起也将DeepSeek V4-Pro的缓存命中价从0.1元上调至1.0元。开源证券研报指出,大模型厂商正从"以低价换市场"向"以价值定价"转变,价格战回撤已成行业共识。
DeepSeek自身估值近期快速攀升至约5000亿元人民币,但据传暂停了新一轮融资谈判。V4-Flash的爆发式增长验证了低价策略在用户获取阶段的效率,但也暴露出算力基础设施的瓶颈——峰谷计价已不足以平衡供需,整体提价成为必然选择。
国产大模型开启收费价格链,低价竞争模式出现转折
DeepSeek作为此前国内最低价的大模型API提供商,大幅涨价标志着行业价格竞争逻辑的根本变化。从智谱率先提价83%且调用量反增400%,到阿里云、腾讯云、百度智能云集体上调算力价格,再到硅基流动平台跟随上调,一条自下而上的收费价格链正在形成。
涨价对算力供应商形成直接利好。DeepSeek的算力支出将随调用量扩大而增加,包括服务器租赁、电费和运维成本。峰谷定价已无法消化需求冲击,提价将改善API服务的单位经济。此路径同样适用于其他大模型厂商:智谱的量价齐升已经验证了涨价空间的存在——当模型能力足以留住客户时,提升价格比继续补贴更能支撑持续的研发和基础设施投入。具备自研芯片、算力集群和规模化推理能力的云厂商可能在这一阶段获得更高的成本转嫁能力。
成本端的传导则指向终端应用开发者和企业客户。大量依赖DeepSeek低价API的初创公司和中小型应用,将面临调用成本上升。部分商业模式建立在极低成本API之上的应用可能被迫调整定价或削减用量。但另一方面,DeepSeek在涨价后仍可能是国内市场最具性价比的选择之一,尤其考虑到其缓存命中率和低价基准。短期冲击强度取决于最终宣布的具体涨幅——如果涨幅在50%以内,相较智谱的83%和硅基流动的10倍上调(缓存价从0.1元升至1.0元)仍属温和。
行业结构上,低价竞争模式退出后,模型能力、生态成熟度和商业化效率将成为更重要的竞争维度。具备企业级Agent产品(如阿里的千问办公、字节跳动的办公AI)的厂商,可能通过应用层收费来缓解模型层的提价压力,从而在竞争中保持定价弹性。
| 涉及行业 | 行业影响分析 | 简要理由 |
|---|---|---|
| 互联网服务与基础设施 | 利好 | 大模型涨价带动算力、云服务、推理基础设施需求增加,云厂商定价能力提升,阿里腾讯百度云的AI相关收入有望继续扩大 |
| 应用软件 | 中性 | 依赖低价API的AI应用面临成本上升压力,但深度使用付费模型的企业应用可能因模型质量提升获得更好的商业回报 |
| 半导体 | 利好 | 持续增长的大模型调用量和训练需求支撑AI芯片、HBM和服务器需求,DeepSeek调用激增反映了算力端的供给刚性 |
新闻热点内容来源于媒体公开报道。文章分析仅代表个人观点,不构成投资建议。
