DeepSeek V4 Pro 正式版似乎在毫无预告的情况下突然上线。
北京时间 8 月 12 日周三深夜,DeepSeek 官网 API 文档悄然更新,模型版本已经从此前的 V4-Pro 预览版切换至 DeepSeek-V4-Pro-0813。官方 " 模型 & 价格 " 页面目前已经将 deepseek-v4-pro 对应的模型版本明确标为 DeepSeek-V4-Pro-0813,同时 API 价格暂未出现明显上调。
这意味着,DeepSeek V4 Pro 正式版很可能已经开始通过 API 灰度或正式提供服务。多家科技媒体援引 DeepSeek 官方群流出的评测对比表称,新模型在多项智能体(Agent)测试中的表现已经逼近 Anthropic 前沿模型 Claude Fable 5,部分项目甚至超过 Fable 5;相比此前的 V4 Pro 预览版,整体表现明显提升。

API 文档悄然换版,官方仍未发布正式更新日志
从 DeepSeek 官网的变化来看,这次 V4 Pro 正式版上线颇为低调。
目前 DeepSeek API 官方 " 模型 & 价格 " 页面已经显示,deepseek-v4-pro 对应的模型版本为 DeepSeek-V4-Pro-0813;该模型支持 1M 上下文、最高 384K 输出,并支持 JSON Output、Tool Calls、Responses API、Anthropic API 以及 FIM 等功能。


DeepSeek 的更新日志页面最新一条仍是 7 月 31 日的 V4-Flash 正式版更新。该公告当时明确表示,7 月 31 日仅升级 V4-Flash API,V4-Pro API 及 App/Web 端模型并未改变,并称 "DeepSeek-V4-Pro 正式版将会尽快发布 "。截至目前,这一更新日志页面仍未出现 V4-Pro-0813 的正式发布说明。
由于最先发现变化的并不是 DeepSeek 官方公告,而是 API 文档和实际调用端。因此,严格来说,现阶段更适合将此次事件视为 DeepSeek V4 Pro 正式版已通过 API 上线,而并非 DeepSeek 已发布完整、正式的 V4 Pro 产品公告。
多项智能体测试逼近 Fable 5,预览版到正式版提升明显
真正引发市场关注的,是已经在 AI 社区流传的评测对比表。
媒体援引 DeepSeek 官方群发布的评测表称,DeepSeek V4 Pro 正式版,即 DeepSeek-V4-Pro-0813,在多项测试中已经接近 Fable 5 水平,相比此前的 V4 Pro 预览版能力出现大幅提升。
其中尤其值得关注的是智能体相关测试。
与传统大模型主要考察知识问答、数学推理不同,智能体测试更加接近 AI" 真正干活 " 的能力,包括能否调用工具、执行多步骤任务、编写和修改代码,以及持续推进复杂工作。
这也是 DeepSeek V4 系列从一开始就重点押注的方向。
DeepSeek 在 4 月发布 V4 预览版时就强调,V4 Pro 在 Agentic Coding 评测中达到当时开源模型领先水平,并针对 Claude Code、OpenClaw、OpenCode、CodeBuddy 等主流 Agent 产品进行了适配和优化。V4 Pro 同时支持 1M 上下文以及思考模式,可通过 reasoning_effort 调整思考强度。
7 月 31 日发布 V4 Flash 正式版时,DeepSeek 又披露了智能体能力的大幅增强,包括 Terminal Bench 2.1 达到 82.7、NL2Repo 达到 54.2、DeepSWE 达到 54.4、Toolathlon verified 达到 70.3 等,并明确表示正式版智能体能力远超 V4-Pro-Preview。
如今 V4 Pro 正式版进一步向 Fable 5 靠拢,意味着 DeepSeek 此前在 Agent 方向的积累正在通过后训练和工程优化转化为更强的实际任务执行能力。
不过,由于目前流传的新版评测表主要来自官方群及社区,DeepSeek 尚未在官方更新日志中公布完整的 V4-Pro-0813 基准成绩,因此这些具体分数仍应视为非官方披露数据,而不能与 DeepSeek 正式发布的基准成绩完全等同。
价格暂未上调,但官网已经预告近期将大幅涨价
价格是这次 V4 Pro 正式版上线的另一大看点。
截至目前,DeepSeek 官方 API 价格页面仍显示,V4 Pro 每百万 Token 的缓存命中输入价格为 0.003625 美元,缓存未命中输入价格为 0.435 美元,输出价格为 0.87 美元;按照此前人民币计价口径,大致对应 3 元 / 百万 Token 输入、6 元 / 百万 Token 输出。
也就是说,新版 V4 Pro 目前并没有因为模型能力提升而同步涨价。
此前 DeepSeek 已经把 V4 Pro API 价格从首发价格永久下调至原价的四分之一,输入缓存命中、输入缓存未命中和输出价格分别降至 0.025 元、3 元和 6 元 / 百万 Token。
不过,这次官网实际上埋下了一个值得关注的伏笔。
DeepSeek 目前在价格页面明确写明:" 我们计划在不久的将来上调 DeepSeek API 服务的整体价格 ",而且 " 预计涨幅较大 ",但具体价格仍需等待官方通知。
因此,当前 V4 Pro 正式版 " 能力升级、价格暂不变 " 的状态,未必能够长期维持。
这也让此次更新更像是一场在涨价之前的性能升级与产品切换:DeepSeek 先把新模型推向 API 用户,随后再根据算力供给、调用量和商业化情况调整价格。
一边是 DeepSeek,一边是 Grok:前沿模型竞争突然 " 撞车 "
如果没有 Grok 4.6,这次 DeepSeek V4 Pro 的突然上线可能已经足够引发市场关注。
但时间点实在太巧。
就在 DeepSeek V4 Pro-0813 悄然上线前几个小时,SpaceXAI 刚刚发布 Grok 4.6。
Grok 4.6 在 Artificial Analysis 推出的 GDPVal-AA v2 ——一项面向真实世界专业知识工作的 AI 智能体评估——中取得1753 Elo,排名第一,超过 OpenAI 前沿模型 GPT-5.6 Sol Max 的 1728 分,以及 Anthropic 的 Claude Fable 5 的 1741 分。SpaceXAI 同时称,Grok 4.6 在 Artificial Analysis Intelligence Index 中取得 61 分,与 GPT-5.6 Sol Max 持平。
更重要的是价格:Grok 4.6 API 定价为每百万输入 Token 2 美元、输出 6 美元,SpaceXAI 直接将其定位为其他前沿模型的一半价格。
如今 DeepSeek V4 Pro-0813 又在多项测试中逼近 Fable 5,而且目前仍维持每百万 Token 输入 3 元、输出 6 元的价格。
两款模型几乎在同一时间向市场释放了类似信号:前沿模型的能力差距正在缩小,而价格优势正在成为新的竞争武器。
这对 OpenAI、Anthropic 等传统前沿模型厂商而言,压力并不仅仅来自 " 谁的跑分更高 "。
此前 AI 模型竞争更多围绕 " 最强模型 " 展开,而随着 DeepSeek 和 Grok 不断把性能推向第一梯队,市场开始出现另一种竞争逻辑:如果性能已经足够接近,开发者为什么要为更贵的模型支付数倍成本?
从 " 便宜 " 到 " 能干活 ",DeepSeek 重新冲击智能体市场
DeepSeek V4 Pro 此次升级的意义,也可能超过一次普通的模型版本迭代。
今年 4 月 V4 发布时,DeepSeek 就已经把重点从传统聊天模型转向 Agent,并将百万 Token 上下文、代码工程和工具调用能力作为核心卖点。
随后 V4 Flash 正式版上线,又重点强化 Code Agent 和 Search Agent 等能力。DeepSeek 在 7 月 31 日的更新中甚至直接表示,V4 Flash 正式版的 Agent 能力大幅增强,并在多项 Agent 基准测试中明显超过 V4-Pro-Preview。
如今 V4 Pro 正式版继续向 Fable 5 等顶级闭源模型靠拢,说明 DeepSeek 的竞争目标已经不再只是 " 做一个更便宜的通用大模型 ",而是试图在 AI 从聊天走向实际工作的过程中,争夺 Agent 基础模型的位置。
而这恰恰也是 Grok 4.6 此次升级的核心方向。
Grok 4.6 同样将长时间运行的智能体、复杂编程和知识工作作为重点,并在 Cursor 等开发者入口直接提供服务。
因此,DeepSeek V4 Pro-0813 与 Grok 4.6 的 " 同日撞车 ",某种程度上也折射出 AI 行业竞争的新阶段:
前沿模型的竞争正在从单纯比拼参数和聊天能力,转向比拼智能体执行能力、Token 成本以及开发者生态。
而这场竞争,可能才刚刚开始。