AREX Feed Article
DeepSeek预告API大幅涨价,国产大模型集体告别"白菜价"
8月6日,DeepSeek在开发者平台公告:"计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。" 此时距离该公司发布284B参数的DeepSeek-V4-Flash-0731超低成本模型仅过去一周。
一年之内,从降价75%到预告涨价
DeepSeek在2026年的定价轨迹像一条V形曲线。
4月25日,deepseek-v4-pro模型API开启限时2.5折优惠,百万tokens输入价格(缓存命中)降至0.25元。 5月23日,DeepSeek更进一步,将"限时优惠"升级为"永久2.5折",缓存命中输入价低至0.025元/百万tokens。 此举引发连锁反应,小米MiMo-V2.5系列随即宣布永久降价,最高降幅达99%,一系列降价动作被外界视作国内大模型价格战白热化的标志。
转折发生在6月底。DeepSeek在发送给用户的升级提醒邮件中预告,V4正式版上线后将引入峰谷定价机制,工作日高峰时段(北京时间9:00-12:00、14:00-18:00)调用价格直接翻倍。
当前的峰谷价格框架如下:deepseek-v4-flash缓存命中输入平时0.02元/百万tokens,高峰0.04元;缓存未命中输入平时1元,高峰2元;输出平时2元,高峰4元。deepseek-v4-pro更高一档:缓存命中输入平时0.025元,高峰0.05元;缓存未命中输入平时3元,高峰6元;输出平时6元,高峰12元。
从降价75%到峰谷翻倍再到"涨幅较大"的整体上调,DeepSeek在不到四个月内完成了定价策略的彻底翻转。
单日吞下8万亿Token之后
全球AI模型聚合平台OpenRouter发布的7月27日至8月2日周榜显示,DeepSeek V4 Flash以7.22万亿Token的调用量位居全球第一。 海外开发者平台OpenCode披露的数据更为直观:8月1日当天,V4 Flash在其平台上单日处理Token总量达8万亿,其中5万亿来自免费试用额度,3万亿来自开发者付费调用。
8月4日,deepseek-v4-flash因前所未有的访问量出现容量不足问题,虽随后恢复,但暴露出算力基础设施的紧绷状态。
彭博社8月4日的报道提供了另一重视角:使用DeepSeek V4 Flash完成一项复杂任务的成本仅为3美分,而Anthropic的Claude Fable 5需要3.15美元,OpenAI的GPT-5.6 Sol为1.86美元。
根据网络上流出的DeepSeek创始人梁文锋7月在投资者交流会上的发言,公司的API定价逻辑是"大概是在市场上买一批设备回来,十个月收回成本"。梁文锋认为,在这个价格区间需求是没有弹性的,"价格再翻一倍,token消耗量区别不大,总收入接近一倍"。
涨价的不只DeepSeek一家
2026年以来,国内头部大模型服务商已出现集体性的价格上调。
智谱CEO张鹏在4月的业绩说明会上披露,2026年一季度智谱API调用定价提升83%,但调用量仍增长400%,市场供不应求。 腾讯云连续两次宣布涨价,智谱年内进行了三次API价格上调。 6月,字节跳动旗下豆包专业版采用三级阶梯定价,标准/加强/高级套餐连续包月分别为68元、200元、500元。 7月19日,月之暗面旗下Kimi更因K3发布后48小时内请求量逼近集群承载极限,直接暂停C端新用户订阅。
高盛在一份研报中判断,DeepSeek实施峰谷定价"并不意味着需求走弱,反而反映出国内AI模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战,逐步回归更理性的定价框架"。
涨价也引发了开发者的担忧。AI开发者Michael Guo在社交媒体上评论称,DeepSeek选择此时涨价"难道不是在自找麻烦",他指出Meta的Muse Spark和OpenAI的GPT-5.6 Luna在能力和价格上都已与DeepSeek模型形成竞争。
低价模型的黄金时代正在落幕
界面新闻在报道中指出,过去两年各家为抢占市场份额疯狂压低API单价,但进入2026年下半年,"算力供需、芯片采购成本、运营成本持续走高,单纯靠低价换规模的模式难以为继",行业逻辑正从"拼低价抢用户"逐步转向"成本可承受前提下的商业化"。
DeepSeek目前已启动第二轮融资,计划募资500亿元,投前估值约5000亿元。 与此同时,DeepSeek-V4-Flash正式版API已于7月底上线公测,V4-Pro正式版也"将尽快发布"。
从"价格屠夫"到主动涨价,DeepSeek的转身发生在不到四个月之内。界面新闻援引分析观点称,"API定价回调,反映出厂商开始正视可持续经营问题,但调价也会对中小开发者的AI创新项目带来直接压力"。