关于ZAKER Skills 合作
钛媒体 刚刚

DeepSeekV4 Pro 正式版深夜现身官网,测评超越 Fable 5

昨日深夜,DeepSeek V4 Pro 正式版正式上线,主要通过 API 开放。根据官网 API 文档显示,"deepseek-v4-pro 模型版本已更新为 DeepSeek-V4-Pro-0813"。

同一天内,阿里 Qwen3.8-Max(Qwen3.8-2.4T-A95B )宣布正式开源,马斯克旗下 SpaceXAI 推出了 Grok 4.6,模型之争的节奏正变得越来越快,战场也从单一的参数比拼,转向了性能、成本、商业化与应用生态的综合较量。

DeepSeek V4 Pro 是一款基于混合专家(MoE)模型,其总参数量高达 1.6 万亿,而在实际推理中,每个 token 仅需激活 490 亿参数,在保证强大性能的同时优化了计算效率。

该模型拥有 100 万 token 的上下文窗口,并支持最大 38.4 万 token 的输出长度,能够处理超长文本任务。在交互模式上,V4 Pro 提供 " 思考模式 " 与 " 非思考模式 " 两种选项,其中思考模式为默认设置,便于应对复杂推理场景。

此外,V4 Pro 延续了全面的生态兼容性,全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API 等高级功能,旨在更好地服务于 Agent 和 Coding 场景。

对于开发者而言,本次更新无需修改现有模型名称,只需继续调用 deepseek-v4-pro,即可自动使用最新版本,实现无缝升级。

在 DeepSeek 开展的相关测评中,相比预览版能力大幅提升,多项测试成绩接近甚至超越美国顶级模型 Claude Fable 5,与 Opus 4.8 相比也毫不逊色。例如在 Terminal Bench 2.1 测试中得分 87.9,远超预览版的 72.1。

在外界关心的价格方面,此前 DeepSeek 就已预告 " 计划近期整体上调 DeepSeek API 服务价格,预计涨幅较大 "。

目前 V4 Pro 定价是 V4 Flash 版本价格的 3 倍,具体为:输入(缓存未命中)3 元 / 百万 tokens,输出 6 元 / 百万 tokens,缓存命中的输入则非常便宜,仅需 0.025 元 / 百万 tokens。

值得一提的是,DeepSeek 的权重依然是 MIT 许可证,正式版权重可能随后跟上。

(作者 | 杨丽,编辑 | 杨林)

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容