AREX Feed Article
DeepSeek 官宣 V4-Pro:App/Web 上线「Expert Mode」,推理强度分三档
北京时间 8 月 13 日 19:31,正式宣布发布 DeepSeek-V4-Pro:V4-Pro 现已在 App 和网页端以「Expert Mode」提供,同时可通过 API 调用,模型名称保持不变,参照 API 文档配置即可。公告列出的更新有三项:Agent 能力大幅升级;V4-Pro 与 V4-Flash 支持 low/high/max 三档灵活推理强度,低档用于简单任务、高档用于日常 Agent 工作流、最高档用于复杂任务;原生支持 OpenAI Responses API,并针对 Codex 一键配置。
公告下还有一条:随 V4 系列发布更新 API 定价,引入高峰与低谷两档费率,低谷时段比高峰低 50%,新定价于 2026 年 8 月 16 日 16:00 UTC 生效。发布约两小时后,公告推文已获超过 6500 次点赞、约 35 万次浏览。
这是 DeepSeek 第一次为 0813 构建发布正式公告。此前近 20 个小时里,这个版本已在没有公告的情况下出现在 API 文档的「模型 & 价格」页(),被媒体和开发者先拆解了一遍。
「Expert Mode」上线 App/Web,官方公告补上缺的一环
8 月 12 日 23:41,IT之家报道 API 文档「模型 & 价格」页新增 DeepSeek-V4-Pro-0813,支持思考与非思考两种模式,当时官方没有更新日志。里记录,新模型当时仅限 API 使用,他只能链接到 OpenRouter,因为 DeepSeek 没有为它准备任何明显的公告页。
19:31 的公告补上了这一环:V4-Pro 首次以「Expert Mode」出现在 App 和网页端。而 中提到的「调用模型名不变」、增强 Agent 能力、支持 Responses API 和 Codex 接入,也在公告里得到官方确认。
low/high/max 三档推理强度:V4-Flash 同样覆盖
公告给出的三档定义是:low 用于简单任务,high 用于日常 Agent 工作流,max 用于复杂任务,同时覆盖 V4-Pro 与 V4-Flash。后者 7 月 31 日才上线正式版 API 公测。三档强度此前在 Simon Willison 的实测中以 low/medium/high 出现过;官方公告则给出了 low/high/max 的正式命名和对应场景。
X 用户 Josh()在公告下留言,把这当成省钱开关:「灵活推理强度正是我关心的部分。过去一个月,在琐碎的工具调用上烧 max 级思考,一直在悄悄吃掉我的 agent 账单,今晚就换 V4-Pro。」
Simon Willison 用图像生成做过一次观察:三档推理强度生成的鹈鹕图差别很大,他写道自己在别的模型上没见过这种差异。他博客里 medium 档的输出长这样:
原生 Responses API:为 Codex 一键配置
公告称 V4-Pro 原生支持 OpenAI Responses API,针对 Codex 优化并支持一键配置。援引从 DeepSeek 官方群流出的评测对比表称,正式版兼容 OpenAI 和 Anthropic 两种 API 格式,开发者几乎无需修改代码即可完成切换;上下文长度 100 万 Token,最大输出 384K Token。上文截图中的 API 文档也同时给出两种格式的 BASE URL,模型版本一栏写着 DeepSeek-V4-Pro-0813,上下文长度标为 1M。
「Major Agent upgrades with strong production gains」没有附数字,数字此前已经流出。同一份对比表显示:Terminal Bench 2.1 上 V4-Pro 拿下 87.9 分,距离第一名的 Anthropic Fable 5 只差 0.1 分,较 4 月预览版的 72.1 分提升 15.8 分;DeepSWE 从预览版的 12.8 分升到 62.7 分,超过 Anthropic 上一代旗舰 Opus 4.8 的 58.0 分。
峰谷定价:8 月 16 日 16:00 UTC 生效
观察者网梳理的定价时间线显示,DeepSeek 6 月 29 日就引入过峰谷计费,8 月 6 日又在开放平台公告计划近期整体上调 API 定价、预计涨幅较大。IT之家 8 月 13 日凌晨附出的 0813 定价是:输入(缓存命中)每百万 tokens 0.025 元,输入(缓存未命中)3 元,输出 6 元。
横向看仍然便宜。观察者网对比称,Fable 5 每百万输出 Token 定价 50 美元,DeepSeek V4 Pro 为 0.87 美元,约为前者的五十七分之一。西班牙独立开发者 的留言是:「基本上就是涨价一倍。但就你拿到的东西来说,仍然便宜得离谱。」
官宣前近 20 小时:静默上线、回滚疑云与 Harness 追问
按时间线回放:8 月 12 日 23:41 IT之家首报 0813 出现在 API 文档;8 月 13 日凌晨 2:08,开源编程 Agent 称 DeepSeek「悄然发布」V4-Pro 0813,Terminal Bench 较 4 月预览版提升 15.8%,1.6T 总参数、49B 活跃参数、1M 上下文,达到 Fable 5 级表现、成本却约为 Fable 5 的五十七分之一,并称这是目前市面上性价比最高的模型,已在 ClinePass 上线。Simon Willison 则记录,官方基准表先发到官方微信群,被转贴到 Reddit 后遭版主删除,随后出现在 Hacker News 的 ASCII 表格里。
当天 15:58,中文 AI 博主 (约 2.7 万粉丝)发帖称 0813「失败了」:很多任务思考时间不到 10 秒,复杂问题很快就开始输出;他怀疑北京时间凌晨 3 点左右发生过一次紧急回滚,模型可能切回了此前的 Preview 版。他给出的证据是同一类直升机 3D 游戏任务在 0:50 和 4:37 两次测试的表现肉眼可见地不同,4:37 那次约 4 分钟做出了相当完整的结果。他的判断偏向服务端:「问题可能并不完全出在模型本身」,更可能是集群部署、推理配置或服务端 Harness 出了问题。
回滚的说法目前只有这一个信源,19:31 的官方公告也没有提到回滚。
公告同样没有回答评论区反复出现的另一个问题:Harness 什么时候来。观察者网援引媒体报道称,DeepSeek Harness 于 2026 年 5 月内部立项,由崔添翼负责,「DeepSeek Harness 团队」公众号 7 月 6 日注册,8 月 1 日公开征集过内测用户。公告下「」之类的留言不止一条;LLM 推理框架 则留言:「Another impressive jump! Can't wait to run it with DeepSeek Harness!」(又一次大跃升,等不及要拿 DeepSeek Harness 跑它了)。
回滚疑云与 Harness 时间表,官方公告都没有给出答案。下一个确定的时间点是 8 月 16 日 16:00 UTC,新的峰谷定价届时生效。