
编辑|徐青阳
9 月 8 日下午,DeepSeek 在官方交流群中开启 DeepSeek V4.1 Flash中间版本内测。根据官方群内通知,新模型采用了新的模型结构,原生支持多模态,同时在能力、速度和成本上进一步优化。
目前,这并不是一次正式公开发布。腾讯科技查询发现,截至发稿,DeepSeek 官网、API 官方文档和 Change Log 中均尚未出现 V4.1 Flash 的正式发布记录,公开 API 文档目前列出的仍是 DeepSeek-V4-Flash-0731、DeepSeek-V4-Pro-0813 和此前上线的 DeepSeek-V4-Flash-Vision-Exp。
根据 DeepSeek 官方交流群给出的调用方式,开发者无需修改原来的 base_url,只需将模型名称改为:deepseek-v4.1-flash-expires-on-0910 即可调用。
目前该模型计费方式与 deepseek-v4-flash 相同,每个账号最多支持 20 路并发。
模型 ID 中的 "expires-on-0910" 也意味着,这可能是一个将在9月10日到期的临时测试端点。从目前的信息来看,DeepSeek 此次更像是在正式版本确定之前,把一个中间 checkpoint 放入真实 API 环境中进行短期测试。
更值得关注的是,DeepSeek 第一次明确提到:新的模型结构和原生多模态。

DeepSeek 实际上已经提前为多模态铺了路。
8 月 21 日,DeepSeek 正式上线了实验模型 DeepSeek-V4-Flash-Vision-Exp。根据 DeepSeek 官方 Change Log,这个模型可以同时接受图片和文本输入,也是 V4 Flash 系列第一次正式具备视觉理解能力。
不过,当时的处理方式仍然相对独立。
DeepSeek 目前的 API 文档把 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 列成两个单独的模型。其中,前者对应 DeepSeek-V4-Flash-0731,后者才支持图片输入。
DeepSeek 官方当时也明确表示,Vision Exp 在纯文本 Agent、推理和知识能力上与普通 V4 Flash 基本相当,主要提升来自需要视觉理解的 Agent 任务。官方称,在这类任务上,多模态 Agent 能力已经 " 接近 Opus 4.8"。
这和 V4.1 Flash 此次透露出的信息存在明显区别。
DeepSeek 在内测通知中使用的是 "原生多模态支持",同时强调"采用了新的模型结构"。如果最终正式版本延续这一设计,就意味着 DeepSeek 可能正在把此前相对独立的视觉能力进一步整合进基础模型,而不再只是给 V4 Flash 额外提供一个 Vision 实验版本。
不过,目前 DeepSeek 尚未公布 V4.1 Flash 的技术报告、参数规模、架构细节和 benchmark,因此还不能据此判断具体采用了什么多模态架构,也不能确认它与现有 V4 Flash-Vision-Exp 之间的技术继承关系。
" 新架构 " 究竟新在哪里,目前仍然是这次内测留下的最大悬念。
V4 Flash 刚刚才更新一个多月
V4.1 Flash 出现的速度也相当快。DeepSeek 在今年 4 月 24 日正式推出 V4 系列,提供 V4 Pro 和 V4 Flash 两个版本。
7 月 31 日,DeepSeek 又更新了 V4 Flash。当前 API 中的 deepseek-v4-flash 实际对应 DeepSeek-V4-Flash-0731。
但这一次升级并没有改变模型底层架构。DeepSeek 在官方 Change Log 中专门注明,V4-Flash-0731 与此前 V4-Flash-Preview 保持相同的模型架构和模型规模,只重新进行了Post-training。
尽管没有更换底座,这次后训练仍然大幅加强了 Agent 能力。DeepSeek 公布的测试中,V4 Flash 在 Terminal Bench 2.1 上达到 82.7,NL2Repo 为 54.2,DeepSWE 为 54.4,Toolathlon Verified 达到 70.3。
半个月之后,DeepSeek 又在 8 月 13 日推出正式版 V4 Pro;8 月 21 日进一步补上 V4 Flash Vision Exp。
也就是说,从 7 月底至今一个多月时间里,DeepSeek 已经连续完成了 V4 Flash更新、V4 Pro正式版、V4 Flash Vision Exp 三次模型调整。现在出现的 V4.1 Flash 内测版本,可能改变模型架构。
Flash 可能正在变得越来越重要
还有一个细节值得关注。在 DeepSeek 官方内测反馈问卷中,DeepSeek 直接询问测试用户:
"DeepSeek V4.1 Flash 中间版本能否全面替换线上的 DeepSeek V4 Pro?"

以峰值时段为例,目前 V4 Flash 每百万 tokens 缓存未命中输入价格为 0.44美元,输出为 1.32美元;V4 Pro 分别为 1.32美元和3.96美元,正好约为 Flash 的 3 倍。非高峰时段价格再减半。
目前 V4.1 Flash 内测仍然按照现有 V4 Flash 收费。如果这一版本能够在维持 Flash 定价的同时接近现有 Pro 的表现,它可能为部分使用 Pro 的开发者提供新的选择。实际替代效果仍需测试验证。