8月6日,DeepSeek一则简短公告在开发者社区激起波澜:平台计划近期整体上调API服务定价,预计涨幅较大。 这距离7月中旬引入高峰翻倍计费仅过去三周。这家曾以一己之力将大模型API价格打到地板价的公司,正在释放低价策略进入拐点的明确信号。

回顾DeepSeek的API定价史,2024年4月率先将价格降至输入1元/百万Token、输出2元/百万Token的行业地板价。此后多次下调,去年9月更是一次性降价50%以上。彼时市场将其解读为以亏损换份额的战略决心。
转折始于今年5月。DeepSeek宣布将V4-Pro的2.5折限时优惠转为永久价格,输入降至3元/百万Token、输出6元/百万Token。短短一个月后,6月底DeepSeek宣布V4正式版将引入峰谷定价——工作日高峰时段价格翻倍。当时市场尚可将峰谷机制解读为精细化调度而非涨价。但8月6日的公告彻底打消了这种预期——这次是整体定价中枢上移。
根据DeepSeek开放平台公开定价信息,当前两大主力模型执行多维度计费规则。V4-Flash缓存命中输入仅0.02元/百万Token,缓存未命中输入1元/百万Token,输出2元/百万Token。V4-Pro缓存命中输入0.025元/百万Token,缓存未命中输入3元/百万Token,输出6元/百万Token。
这个价格低到什么程度?按1美元约合7.2元人民币折算,GPT-5.5输出价格为每百万Token约216元,是DeepSeek V4-Pro的30多倍。输出定价每百万Token仅2元,而Anthropic的Claude Opus 4.8完成同样任务需要约170元。
也正因如此,DeepSeek在全球开发者中收获了价格屠夫的称号。
涨价最直接的推力来自需求端。7月31日,DeepSeek-V4-Flash正式版发布,Agent能力大幅增强。据OpenCode平台披露,仅8月1日单日,V4-Flash在该平台处理的Token总量就达到8万亿。
多模型聚合平台OpenRouter最新周度数据显示,DeepSeek V4 Flash以7.22万亿Token的周调用量登顶全球第一。8月4日,平台甚至因前所未有的访问量而出现容量不足问题。有开发者调侃:服务器终于被挤爆了。
需求端的爆发式增长带来了算力成本的急剧攀升。工信部信息通信经济专家委员会委员盘和林分析指出,此次涨价主要源于成本上升。智能体应用增加后,单项任务消耗的Token数量明显高于传统聊天场景。DeepSeek的算力账单正在以超出预期的速度膨胀。
与此同时,整个行业正从拼低价抢用户转向成本可承受前提下的商业化。过去两年,各家大模型疯狂压低API单价,甚至推出大规模免费额度。进入2026年下半年,算力供需、芯片采购成本、运营成本持续走高,单纯靠低价换规模的模式难以为继。
国产大模型涨价已不是个例。智谱2026年一季度API调用定价较2025年底提升约83%,调用量仍增长400%,呈现量价齐升态势。月之暗面7月随Kimi K3发布,API定价大幅上调——输入20元/百万Token、输出100元/百万Token,较前代输入涨幅超3倍、输出涨近4倍。豆包专业版推出三级阶梯订阅套餐,阿里云、腾讯云、百度智能云等年初已集体上调AI算力相关价格。
DeepSeek尚未披露涨价的幅度和生效时间。但业内人士评价,这标志着曾以极致性价比横扫市场的DeepSeek,正在告别持续近两年的低价策略。具体涨价幅度虽待公布,但涨幅较大的表述暗示这或将是一次结构性重新锚定。
对于依赖DeepSeek API的中小开发者和AI初创企业来说,涨价意味着月度推理成本可能面临数倍增长。此前不乏公司因DeepSeek的极致性价比而选择全线迁移——如今,那笔账需要重新算了。正如一位开发者在社交平台所说:梁圣还是小梁,就看涨幅了。