AREX Feed Article
DeepSeek 上架 V4-Pro MIT 开源权重,API 价格最高上调 1,100%
DeepSeek 在 Hugging Face 上架了 :权重以 MIT 协议开源,写明取代此前的 Preview 版。模型卡披露 DSpark 投机解码模块、low/high/max 三档推理强度、vLLM 与 SGLang 部署命令,以及厂商自报的完整基准表——HLE(带工具)60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7、Cybergym 83.3。
8 月 13 日,,DeepSeek 将把 V4-Pro 与 V4-Flash 的 API 价格上调 50% 至 1,100%,并引入峰谷定价,8 月 17 日生效。同一天,DeepSeek :App/Web 上线 Expert Mode、推理强度分三档、原生支持 OpenAI Responses API。模型卡和 Reuters 的涨价细则补上了官方公告没有的基准表、权重协议和具体涨幅。
DSpark 随模型卡公开,一个 flag 开启
模型卡写明,0813 版在 V4-Pro(Preview)结构上挂载了一个 DSpark 投机解码模块。部署上的体现是:vLLM 下加一个 flag 即可开启——--speculative-config '{"method":"dspark","num_speculative_tokens":7,"draft_sample_method":"greedy"}',示例命令在一块 4×GB300 节点上跑通整个模型;SGLang 下用 --speculative-algorithm DSPARK,目标模型与草稿模型权重来自同一份 checkpoint,无需单独指定草稿路径。
卡片还写明,reasoning_effort 支持 low/high/max 三档;本地部署时官方建议采样参数 temperature=1.0,agent 场景 top_p=0.95,high/max 档建议最大输出 384K token。仓库不含 Jinja 聊天模板,另附 encoding 文件夹和 Python 脚本处理 OpenAI 格式的编解码;参数量 1.7T,仓库与权重均为 MIT License。
DeepSWE 从 12.8 跳到 62.7,注脚落在 Harness
基准表列出八个公开基准和两个内部测试集,全部为厂商自报。跳升最大的是 DeepSWE:12.8 → 62.7;Terminal Bench 2.1 从 72.1 到 87.9,Cybergym 从 52.7 到 83.3,HLE(带工具)从 48.2 到 60.0,Toolathlon-Verified 从 55.9 到 74.1,NL2Repo 从 38.5 到 61.5,AutomationBench 从 12.8 到 31.8,Agents' Last Exam 从 16.5 到 25.7。表里另有两个内部测试集:DSBench-FullStack 71.1、DSBench-Hard 67.2。
同一张表把 GLM-5.2、Kimi K3、Opus-4.8、Fable-5(w/ fallback)列作对照:Terminal Bench 2.1 上,0813 的 87.9 高于 Opus-4.8 的 85.0 和 GLM-5.2 的 81.0,低于 Fable-5 的 88.0 与 Kimi K3 的 88.3;DeepSWE 的 62.7 高于 Opus-4.8 的 58.0,低于 Kimi K3 的 67.5。
表下注脚交代了评测方式:公开基准中的 Code Agent 任务全部用 DeepSeek Harness 极简模式作为 agent 框架评测,max 档、temperature=1.0、top_p=0.95;官方公告补了一句,其他框架下结果可能略有不同。
API 价最高涨 1,100%,峰谷档 17 日生效
官方公告把涨价机制写成峰谷定价:闲时价格为高峰时段的一半,北京时间 2026 年 8 月 17 日 0 时生效;写的是 8 月 16 日 16:00 UTC,同一时刻。Reuters 补充,涨幅取决于模型、token 类型和使用时段。
给出绝对价格:据独立基准机构 Artificial Analysis,V4-Pro-0813 为每百万输入 token 1.32 美元、每百万输出 token 3.96 美元,约为 V4 Flash(0.14 美元/0.28 美元)的 9 倍和 14 倍。报道还提到,上月发布的 V4 Flash 曾在多项独立测试中意外超过 4 月发布的 V4 Pro Preview,这次正式版发布后,Artificial Analysis 给 V4 Pro 推理版的 Intelligence Index 打 53 分,V4 Flash 为 40 分。
微信上招人的 Harness,进了官方评测注脚
Bloomberg 报道(),DeepSeek 注册了「DeepSeek Harness Team」微信公众号,主体是一家北京公司,企查查显示由 DeepSeek 控制,账号经腾讯认证。团队正在招聘,目标是打造能对标 Anthropic Claude Code 的 agent 产品;harness 指包在大模型外、让 agent 处理更复杂任务的软件脚手架。
Reuters 报道称,DeepSeek 计划让各部门人员至少翻倍,包括数据中心和 AI agent 团队。Straits Times 还提到,DeepSeek 8 月 11 日已在官方微信渠道宣布 V4 Pro 的 agent 能力更新,并在非工作时段未回应置评请求。
现在 Harness 的名字出现在模型卡基准注脚里:官方评测 Code Agent 任务用的就是 DeepSeek Harness 极简模式。
MIT 权重与涨价并存,自部署绕开价目表
第一财经把这波更新放进同一条时间线:,阿里开放 Qwen3.8-2.4T-A95B 权重,是其首次开放 Max 级旗舰权重;几天前 Meta 发布开源模型 Muse Glimmer,并预告开放 Muse Spark 1.2 权重。该报道援引 Hugging Face 2026 春季报告称,中国自研开源模型下载占比 41%,首次超过美国;Counterpoint 评价,若西方巨头只建封闭的花园,开发者和企业会转向中国的开放权重模型。
对 DeepSeek 用户,涨价与开源现在并存:API 用户面对最高 1,100% 的涨幅,而 MIT 权重加上随卡给出的 vLLM/SGLang 配方,意味着自部署用户绕开 API 价目表。Reuters 写道,DeepSeek 的意图是把更强的基准表现转化为旗舰级溢价。