关于ZAKER Skills 合作
每日经济新闻 8分钟前

王炸!梁文锋、马斯克同日上新!DeepSeek 涨价,中美大模型价差正在收窄

记者 | 罗雪琳

编辑 | 程鹏 兰素英 杜恒峰 校对 |张锦河

8 月 12 日,DeepSeek 与马斯克旗下 SpaceXAI 同日发布新模型 DeepSeek-V4-Pro 和 Grok 4.6,新一轮大模型竞争再次升温。

从最新评测来看,两款模型均进一步逼近全球头部水平。其中,DeepSeek-V4-Pro 在多项智能体相关测试中超过 Anthropic 的 Claude Opus 4.8;Grok 4.6 则在 Artificial Analysis 智能指数中追平 OpenAI 旗舰模型 GPT-5.6 Sol。

能力差距缩小的同时,中美大模型之间悬殊的价格差距也在发生变化。摩根士丹利最新研报显示,中国大模型 API 平均价格过去一年明显上涨,而美国闭源模型价格近期持续下降,中美大模型价格差距正在收窄。

摩根士丹利指出,中国大模型市场的竞争重点正在从 " 价格战 " 转向 " 智力战 "。

8 月 13 日晚,DeepSeek 发布 API 调价公告,将对 DeepSeek API 价格进行更新调整。(DeepSeek 发布调价公告,8 月 17 日生效)

DeepSeek-V4-Pro 正式版

Agent 性能大幅提升

8 月 12 日晚,DeepSeek 更新官方 API 文档,正式上线旗舰模型 DeepSeek-V4-Pro,API 及 Chat 端已同步更新。

这是继 7 月 31 日 DeepSeek-V4-Flash-0731 正式上线后,DeepSeek V4 系列迎来的又一次更新。

从 DeepSeek 公布的评测结果来看,此次 V4-Pro 正式版的主要提升集中在 Agent 能力。

与 DeepSeek 今年 4 月发布的 V4-Pro 预览版相比,正式版在多项 Agent 相关测试中的成绩明显提高。其中,考察软件工程能力的 DeepSWE 得分由 12.8 升至 62.7;高难度数据科学任务测试 DSBench-Hard 得分由 31.1 升至 67.2;终端操作能力测试 Terminal Bench 2.1 得分由 72.1 升至 87.9;网络安全测试 Cybergym 得分由 52.7 升至 83.3;HLE 带工具测试则由 48.2 升至 60.0。

DeepSeek 还将 V4-Pro 与 Anthropic 旗下的 Claude Opus 4.8 和 Fable 5 进行了比较。官方公布的评测数据显示,V4-Pro 在多项测试中超过 Claude Opus 4.8,与 Fable 5 则各有胜负。其中,在 Terminal Bench 2.1 中,V4-Pro 得分 87.9,与 Fable 5 的 88.0 基本持平;在 Cybergym 中,V4-Pro 以 83.3 略高于 Fable 5 的 83.1;在 DSBench-FullStack 中,V4-Pro 得分 71.1,低于 Fable 5 的 77.2。

8 月 13 日,半导体与 AI 研究机构 SemiAnalysis 在社交平台发文称,DeepSeek-V4-Pro 在 Agent 任务上的表现大幅超过英伟达 Nemotron 3 Ultra。其引用的 Terminal Bench 2.1 数据显示,Nemotron 3 Ultra 得分 53.9,V4-Pro 则达到 87.9。

除性能升级外,V4-Pro 支持 100 万 Token 上下文窗口和最高 38.4 万 Token 输出,并同时支持思考与非思考模式,其中思考模式默认开启。DeepSeek 官方 API 文档显示,新模型还支持工具调用等功能,并同时兼容 OpenAI 和 Anthropic 两套 API 格式。

8 月 13 日,DeepSeek 发布 API 调价公告,将对 DeepSeek API 价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00 — 12:00、14:00 — 18:00(其余为空闲时段)。新价格将于北京时间 2026 年 8 月 17 日 00:00 开始生效。deepseek-v4-pro 高峰时段百万 tokens 输出,最高价格达 27 元。

去年 2 月 26 日,DeepSeek 在其 API 开放平台发布错峰优惠活动通知。北京时间每日 00:30 — 08:30 为错峰时段,API 调用价格大幅下调,其中 DeepSeek-V3 降至原价的 50%,DeepSeek-R1 降至 25%。

今年 5 月 22 日,DeepSeek 宣布 V4 Pro 模型 API 价格在 5 月 31 日限时 2.5 折优惠结束后,永久降至原价的 1/4(即 2.5 折价格永久化),降幅高达 75%。调价后,输入(缓存命中)0.025 元 / 百万 Tokens、输入(缓存未命中)3 元 / 百万 Tokens、输出 6 元 / 百万 Tokens。这创下了当时全球顶级大模型的最低价纪录。

不过 6 月 DeepSeek 的定价策略开始转变。

6 月底,DeepSeek 预告 V4 正式版上线后将引入峰谷定价机制:平时价格不变,但高峰时段调用价格直接翻倍。

Grok 4.6 性能追平 OpenAI 旗舰模型

单任务成本与 Kimi K3 持平

当地时间 8 月 12 日,SpaceXAI 发布新一代大模型 Grok 4.6,这距离上一代 Grok 4.5 发布仅一个多月。Grok 4.6 主要面向长时间运行的 AI 智能体,以及更复杂的交互和视觉任务。

从 AI 模型评测机构 Artificial Analysis 的最新评测结果来看,Grok 4.6 的综合得分已经追平 OpenAI 旗舰模型。

Artificial Analysis 8 月 12 日公布的数据显示,在最新版本的 Artificial Analysis Intelligence Index(智能指数)中,Grok 4.6 获得 61 分,与 OpenAI 的 GPT-5.6 Sol 并列,低于 Claude Opus 5 的 63 分和 Claude Fable 5 的 62 分,高于 Kimi K3 的 60 分和 DeepSeek-V4-Pro 的 53 分。

Artificial Analysis 将这一指数用于综合衡量不同模型的能力表现,并明确标注分数越高越好。该指数综合了 9 项评测,包括用于测试高经济价值职场任务的 GDPval-AA v2、终端操作测试 Terminal-Bench v2.1,以及 Humanity's Last Exam、GPQA Diamond 等。

性能提升的同时,Grok 4.6 并未同步涨价。SpaceXAI 公布的价格显示,新模型每百万 Token 输入和输出价格分别为 2 美元和 6 美元,与上一代 Grok 4.5 保持一致。相比之下,Claude Opus 5 的每百万 Token 输入和输出价格分别为 5 美元和 25 美元,GPT-5.6 Sol 分别为 5 美元和 30 美元。

Artificial Analysis 从完成一项智能指数测试任务所产生的实际 Token 消耗出发,对不同模型的单任务成本进行了测算。结果显示,Grok 4.6 完成一项测试任务的平均成本为 0.84 美元,与 Kimi K3 持平。

马斯克也在新模型发布后密集宣传 Grok 4.6。媒体 8 月 13 日报道称,模型上线后约两小时内,马斯克转发了约 10 条相关推文,并称 Grok 4.6" 智能、快速且性价比超高 ",在同时考虑智能水平、速度和成本的情况下 " 客观上是第 1"。

中美大模型价差正在收窄

中国市场从 " 价格战 " 转向 " 智力战 "

DeepSeek 此前预告的 " 大幅涨价 " 落地,中国大模型的价格正在整体上行。

摩根士丹利 8 月 9 日发布的研报《告别价格战,打响智力战》(Intelligence War Over Price War)显示,其统计字节跳动、阿里巴巴、百度、腾讯、MiniMax、智谱、月之暗面和 DeepSeek 等厂商官方报价后发现,2026 年第二季度,中国大模型平均 API 输入价格已经升至每百万 Token 4.9 元,输出价格升至 21.9 元,相比 2025 年第一季度的 3.3 元和 12.2 元,分别上涨约 48% 和 80%。

摩根士丹利认为,中国大模型行业正在建立更加健康的商业化环境,竞争重点也在从价格转向模型能力。摩根士丹利认为,这一变化可能与 V4 系列需求增强带来的定价能力提升、维持合理毛利以支持前沿模型持续投入,以及推理成本等因素有关。随着模型能力和规模继续提升,中国新一代大模型的定价可能进一步上升,行业竞争将更多转向模型能力和算力供给。

研报进一步指出," 模型智能,而非价格,才是大模型长期竞争地位的关键决定因素 "。原因在于,头部模型厂商可以推出价格更低、能力稍弱的模型进入大众市场,但普通模型厂商要反过来追赶至最前沿水平则困难得多。持续提升前沿模型能力还需要大量训练和算力投入,单纯依靠低价争夺市场可能压低毛利,并进一步限制下一代模型研发所需的资金。

中国模型涨价的另一面,则是美国头部模型价格下降,中美之间悬殊的模型价格差距正在缩小。

摩根士丹利 8 月 12 日发布的另一份研报指出,2025 年一季度中国大模型输入、输出 API 均价仅分别占到美国同行的 6%、5%,到 2026 年二季度,这两个指标的占比已上涨至 19% 与 14%。随着中国模型价格上涨,以及美国厂商继续下调模型价格,这一差距预计还将进一步收窄。研报认为,中国模型已经 " 不再像过去那么便宜 ",与此同时,美国厂商特别是中低端模型仍存在进一步降价空间。

从 Silicon Data 的 LLM Token 价格指数也可以看到这一变化。截至 2026 年 8 月,闭源模型 Token 价格指数已从此前超过 4 美元的高位快速降至 3.07 美元;同期,开源模型 Token 价格指数约为 0.66 美元。摩根士丹利指出,开源模型使用比例上升与闭源模型降价正在共同推动整体 Token 价格下降。

(免责声明:文章内容和数据仅供参考,不构成投资建议。投资者据此操作,风险自担。)

|每日经济新闻 nbdnews 原创文章|

未经许可禁止转载、摘编、复制及镜像等使用

每日经济新闻

最新评论

没有更多评论了
每日经济新闻

每日经济新闻

经济数据提前公布,事实新闻一手掌握

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容