算力紧张!DeepSeek高峰时段API价格翻倍

6月29日,多位开发者收到DeepSeek发送的升级提醒邮件,确认V4正式版计划于7月中旬上线,届时将引入峰谷定价机制,高峰时段API价格为平时的2倍。
DeepSeek方面表示,此举旨在"更合理地配置资源、提升服务稳定性"。对于长期享受低价红利的企业开发者而言,这封信不仅意味着账单即将翻倍,更标志着大模型行业延续数年的"无限畅享"时代正在加速终结。
根据邮件披露的规则,高峰时段为北京时间每日9时至12时、14时至18时,几乎覆盖了国内开发者和企业用户最主要的工作时间。
以V4 Pro为例,高峰时段缓存命中输入价格为0.05元/百万Tokens、缓存未命中输入6元/百万Tokens、输出12元/百万Tokens,较平时价格直接翻倍。
值得注意的是,V4预览版在5月刚刚宣布将限时2.5折优惠转为永久降价,如今引入峰谷定价后,非高峰时段仍维持原有低价,但实际在工作时间调用API的企业用户将直接面临成本翻倍。
此次调价的直接原因是算力资源紧张。官方页面显示,V4 Flash并发限制为2500,而高性能版V4 Pro并发限制仅为500,供给弹性明显不足。但深层原因不止于此。
自2026年以来,智谱已在年内进行三次API价格上调,累计涨幅超60%;腾讯云混元系列部分模型涨价幅度高达463%;阿里云、百度智能云的主流AI算力产品普遍上调5%至50%。云厂商的集体提价并非偶然——AI从简单对话升级为可自主完成数十轮调用的智能体后,单次复杂任务的Token消耗是普通聊天的数十倍甚至上百倍。
据公开数据,豆包大模型日均Token使用量已突破120万亿级别,两年时间暴涨1000倍。算力需求的指数级增长与芯片、内存产能的长周期扩产之间的矛盾,使得算力成本上涨成为行业不可逆的长期趋势。
放眼整个大模型行业,一个清晰的K型分化格局正在形成。DeepSeek和小米选择依托模型架构创新和推理系统优化压低单位成本,走"高质低价"的普惠路线。而OpenAI、Anthropic、智谱等头部厂商则在复杂推理和长链路自主任务上持续涨价,凭借前沿能力溢价获取高毛利。
正如业内分析所判断的:"未来只有两种模型能活下来,要么足够出色,要么非常便宜。"DeepSeek此次引入峰谷定价,本质上是在"足够便宜"与"资源可持续"之间寻找新的平衡——非高峰时段保持低价竞争力,高峰时段通过价格杠杆调节算力分配。
这一步,既是算力稀缺背景下的必然选择,也是大模型行业告别粗放式增长、迈入精细化运营时代的标志性信号。
