AREX Feed Article
财经六组实测:DeepSeek 涨价后真实成本最高涨 5.8 倍
《财经》主笔吴俊宇 8 月 18 日发布了一组涨价前后对照实测:用开源智能体框架 OpenCode 调用 DeepSeek API,反复执行同一任务,从谷歌 24 个季度财报中提取 10 项财务指标、汇总成一张 Excel 表,每次消耗 1 亿 Token,共跑六次。
,DeepSeek-V4-Pro 每 1 亿 Token 使用成本从涨价前的 17.5 元升至闲时 50.1 元、高峰 102.2 元;V4-Flash 从 6.4 元升至 13.1 元、25.7 元。
按《财经》的计算,V4-Pro 实际成本涨至原来的 2.9–5.8 倍,V4-Flash 为 2.0–4.0 倍。相比价目表上的名义涨幅,这组数字给出的是用户实际账单的变化。
背景是 DeepSeek 的峰谷定价落地。,DeepSeek 8 月 13 日公布新版 API 价格、8 月 17 日零时生效:两款模型首次采用峰谷计价,高峰为北京时间 9:00–12:00、14:00–18:00 共 7 小时,其余 17 小时闲时价格打五折,计费项涨幅介于 50%–1100%。
但价目表涨幅不等于账单涨幅,用户实付由缓存命中、未命中输入、输出三类 Token 的价格与占比共同决定,这正是《财经》跑六次实测要回答的问题。
同样的任务六次实测,账单涨幅落在 2–5.8 倍
六次测试的 Token 结构高度一致:缓存命中占 95.9%–97%,未命中输入占 1.6%–2%,输出占 1.2%–2%。《财经》称这是典型智能体任务的消耗结构,具有普遍参考价值。
多数需要持续调用上下文的智能体任务,缓存命中占比通常超过 90%,实际成本不会与本次实测出现巨大差异。
三类 Token 的涨价幅度不同:V4-Pro 高峰时段缓存命中输入 +1100%、未命中输入 +200%、输出 +350%(6 元升至 27 元)。
价目表上最扎眼的缓存命中涨幅没有直接变成账单涨幅,因为 0.025 元的单价基数极小;对账单影响更大的是输出价和未命中输入价,单价绝对值高出一个数量级。
两类模型、三类 Token 的不同涨幅叠加,最终把 V4-Pro 账单推到 2.9–5.8 倍、V4-Flash 推到 2.0–4.0 倍。
涨完价仍是最便宜的企业旗舰
《财经》用同一任务测试主流模型的实际 Token 成本:涨价后高峰时段的 V4-Pro 每 1 亿 Token 为 102.2 元,仅为 OpenAI GPT-5.6 Sol 的 22%、智谱 GLM-5.2 的 36%;闲时 50.1 元,低于大部分国内外主流模型。
由于此前价格基数低,DeepSeek 涨价后的绝对成本仍然更低。
按《财经》配发的对比图,同一任务下每 1 亿 Token 成本从高到低为:OpenAI GPT-5.5 620.5 元、月之暗面 Kimi K3 565.6 元、GPT-5.6 Sol 465.8 元、阿里云 Qwen3.8-Max(正式版)348.3 元。
智谱 GLM-5.2 为 281.8 元、火山引擎 Doubao-Seed-Evolving 为 216.9 元,DeepSeek 各价位全部垫底。
但企业侧的竞争正在逼近。多位中国云厂商销售对《财经》表示,阿里云、腾讯云、火山引擎以及智谱在向战略客户销售 GLM-5.2 时可提供五折优惠、接近成本价。
按五折计算,GLM-5.2 每 1 亿 Token 成本只比高峰时段 V4-Pro 高 38%,而在复杂代码任务中能力优势明显。
个人 Token 套餐里,DeepSeek 已无价格优势
Token Plan 是按月订阅、给定额度调用量的模型套餐,通常比 API 按量计费便宜,更受个人开发者欢迎。《财经》购买了国内外主流 Token 套餐,按实际可用额度与测试任务的 Token 结构折算每 1 亿 Token 成本。
折算结果:ChatGPT/Codex 200 美元/月套餐约 12.5 元,智谱 Coding Plan 约 25.1 元,火山引擎 Agent Plan 约 50.2 元,月之暗面 Kimi Allegro 约 95.4 元,阿里云 Token Plan 约 101 元。
对比之下,涨价后高峰时段的 V4-Pro 达到 102.2 元,与阿里云、Kimi 的套餐价格接近;闲时也要 50.1 元,甚至高于折算后 ChatGPT/Codex 的 12.5 元。
涨价前 17.5 元的 DeepSeek 明显低于所有主流套餐,如今已进入国产旗舰模型套餐的价格区间,靠低价吸引个人开发者的优势正在消退。
OpenCode 首日数据:V4-Flash 少用 6.17 万亿 Token
DeepSeek 官方没有披露涨价后的调用变化,第三方平台提供了观察窗口。全球开源智能体平台 OpenCode 提供包含多种模型调用额度的 Token 套餐,DeepSeek 是其主要接入模型之一。
涨价后,OpenCode 同步调低了套餐内 DeepSeek 的可调用额度:10 美元/月的 OpenCode GO 套餐中,V4-Flash 月调用额度从 18,900 次降至 3,800 次(约减 80%),V4-Pro 从 5,200 次降至 1,050 次。
实际用量变化更直接:8 月 17 日涨价后,OpenCode 平台上 V4-Flash 的调用量较 8 月 16 日减少 6.17 万亿 Token(-59.1%),V4-Pro 减少 0.71 万亿 Token(-55.7%)。
《财经》分析,OpenCode GO 吸引的主要是入门级 AI 用户,常用 V4-Flash 跑批量采集信息、整理数据等自动化任务,这类任务对能力要求不高、Token 消耗量大,价格一变,调用量立刻收缩。
V4-Pro 卡在 Flash 与 GLM-5.2 之间
企业用户侧的性价比也在下降。《财经》的判断是,V4-Pro 处在一个尴尬位置:日常办公等简单任务有更快更便宜的 V4-Flash;复杂代码、智能体等高价值任务又要面对 GLM-5.2、Kimi K3 等国产旗舰的竞争。
在复杂代码任务中,V4-Pro 能力相对不足,价格优势正被削弱,尤其在国内云厂商持续补贴旗舰模型的背景下。涨价后的 V4-Pro 依然不贵,但不再是一个几乎没有竞争对手的低价旗舰。
接下来要看的是 DeepSeek 官方 API 能留住多少调用量。援引 Vercel 生产指数称,今年 6 月开放权重模型处理了 29% 的 Token,却只对应不到 4% 的支出。
该分析认为,DeepSeek 在即将 IPO 的节点上调价格,测试的正是「价格不再只向下走,开发者还会不会留下」。OpenCode 首日数据已经给出了一部分答案:价格敏感用户正在减少调用。