
DeepSeek、智谱、月之暗面、MiniMax、阿里、字节、腾讯……几家平时你追我赶的模型厂商,难得集体安静了下来。
整整七天不见熟悉的跑分大战和价格战,甚至就连海外网友都发出疑惑:中国模型怎么没动静了?

OpenAI 刚在 DevDay 上扔出 20 多项更新,10 月 4 日又宣布开启为期 28 天的连续更新;Anthropic 也没闲着,10 月 7 日推出 Haiku 5.5,补齐了 Claude 5.5 模型家族。
当然,模型公司并没有全年无休的义务,十一放假本来是再正常不过的事情。
但之前的长假可不是这样。去年十一前后,几家大厂还在扎堆更新模型;今年春节更是热闹,连除夕都没能让模型发布停下来。
相比之下,今年十一简直安静得有些反常。
难不成,国内的 AI 工程师都放假了么?
A
发个模型好过节,似乎已经成为了某种心照不宣的默契。
去年 1 月 20 日,DeepSeek 赶在春节前发布 R1,直接掀起了一场席卷全球 AI 圈的热潮。模型权重和技术报告一起开源,开发者忙着部署、测试,各家云厂商忙着接入,整个 AI 圈都跟着加班。


到了十一,去年 9 月 29 日,DeepSeek 又赶在假期前发布了 V3.2-Exp,引入稀疏注意力机制 DeepSeek Sparse Attention,重点解决长上下文推理的效率问题,同时大幅降低了 API 调用价格。



2 月 12 日,智谱和 MiniMax 同一天发布 GLM-5 和 M2.5,字节也推出了新一代视频生成模型 Seedance 2.0。



相比之下,今年十一确实安静得有点反常。
倒也不是完全没动静—— 9 月 27 日,MiniMax 赶在节前上线了 M3.1-Flash-Preview,我们也实测了这款模型。
但此前备受期待的 DeepSeek V4.1 Pro 依然没有亮相,豆包 2.2 也迟迟不见踪影。智谱、月之暗面、阿里、腾讯等厂商,同样没有在假期里掀起什么新的发布大战。
国内模型圈就这样难得安静了下来。
在那条讨论中国模型为何突然没动静的帖子下面,有网友解释,中国刚刚结束了一年中最长的公共假期之一。
" 而现在,游戏重新开始了。"
他甚至已经列好了自己的节后愿望清单:DeepSeek V4.1 Pro(甚至 V4.5)、GLM-5.5,以及 Kimi-4。

B
模型更新静悄悄,模型公司倒是没闲着。
9 月 28 日、29 日,DeepSeek Harness 连续推出两个候选版本;到了 10 月 3 日,眼看着海外 A 厂刚刚开放 Claude Code Mods,DeepSeek 又在十一假期里上线了 v0.2.1-alpha.1,加入了实验性的 Claude Code Mods 兼容,并支持让 Agent 自己创建插件。

9 月 30 日,DeepSeek 宣布开源面向华为昇腾芯片的一批底层计算和通信组件,包括 DeepGEMM-Ascend、DeepEP-Ascend 等,同时推进基于 128 颗昇腾 950 芯片的超节点方案。

智谱这边,忙的则是把模型卖出去。
10 月 5 日,AWS 正式宣布,GLM-5.3 上线 Amazon Bedrock。
海外企业现在可以直接通过 AWS 的托管服务调用这款模型,不必自行部署推理环境。此前 Kimi、DeepSeek 等国产模型已经陆续进入海外云平台,智谱如今也加入了这场争夺全球企业客户的生意。

10 月 6 日,路 · 透社报道称,DeepSeek 正在筹集超过 800 亿元的新一轮融资,最高可能达到 1000 亿元,目标估值约 5000 亿元,腾讯、宁德时代等企业据称参与其中。

7 月底,月之暗面就传出融资与赴港上市的计划。到了 10 月 6 日,彭 · 博社进一步报道称,公司已经完成上市前最后一轮私募融资,估值升至约 500 亿美元,计划最快 2027 年第一季度在香港上市。

原生 AI 公司忙着更新工具、寻找客户、筹集资金。那些 " 家底丰厚 " 的互联网大厂,则在继续给 AI 加码。
十一当天,《金融时报》披露,腾讯据报与甲骨文签订了价值约 70 亿美元、为期五年的海外算力租赁协议,涉及部署在东南亚数据中心的约 10 万颗先进 AI 芯片。

10 月 8 日,彭 · 博社又传出消息,称腾讯正在考虑发行最多 50 亿美元的离岸债券,为 AI 和计算基础设施投入筹集资金。

9 月 22 日,阿里在云栖大会上公布了新一代自研 AI 芯片真武 V900,并提出到 2032 年将全球数据中心运营容量扩展至 20GW 以上;字节则在 9 月初筹集了 296 亿美元银团贷款,据报其中相当一部分资金将投向 AI 和基础设施建设。
这么一圈看下来,国内大模型厂商这个十一,忙的事情其实不少。只是这些动作没那么容易登上跑分榜,也少了几分新模型发布时的热闹。
不过,这些动作和模型发布并不冲突,所以问题还是那个问题:模型公司明明没闲着,怎么新模型就没动静了呢?
C
翻翻各家的发布记录,上一次让人眼前一亮的国产旗舰模型,似乎还是阶跃 9 月 20 日的 Step 5 Preview 和小米 9 月 22 日的 MiMo-V2.6。
再往前看,9 月 10 日,DeepSeek 推出 V4.1-Flash,首次展示新一代模型架构,但更受期待的 V4.1 Pro 尚未亮相;智谱 8 月 14 日发布 GLM-5.3,随后又接连推出采用新基座的 GLM-5.3-Flash 和主打推理速度的 FlashX;月之暗面的 Kimi K3,则要追溯到 7 月中旬。
其他几家的情况也差不多。阿里 8 月初发布 Qwen3.8-Max,字节 6 月推出 Seed2.1 系列,腾讯则在 8 月底开源混元 Hy4 Preview。
几家厂商并没有闲着,专项模型和高速版本陆续推出,但最受关注的几款下一代旗舰始终没有全部到位。尤其是刚刚过去的十一假期,国内大模型市场没有迎来熟悉的扎堆发布场面。
更何况,有些本来就在等待名单里的模型,迟迟没传来新消息。
9 月 10 日发布 V4.1 Flash 时,DeepSeek 就在官方公告里提到了尚未上线的 V4.1 Pro,还表示旧版 V4 Pro 接口将暂时切换至 Flash,等待新的 Pro 版本推出。

结果,假期过去了,V4.1 Pro 并没有亮相。
字节的豆包 2.2 更是已经让大家等了很久。
早在 8 月底,就有媒体报道称,原计划 8 月推出的豆包 2.2 将延期。据接近字节的人士透露,团队还想在编程、工具调用和 Agent 能力上继续打磨。
然后八月等到九月,九月又等到十一——就连谷歌都在十一前官宣了 Gemini 4 Argon,豆包 2.2 都快成模型界的新一代戈多了。
当然,玩笑归玩笑,模型没有如期到来,可能有很多原因。
最简单的一种解释,就是大家真的放假了。
毕竟之前的假期有人发布模型,并不意味着 AI 工程师从此失去了享受法定假期的权利。
何况模型训练有自己的周期,评测、优化、上线也不是按日历推进的。要是恰好赶在节前准备好了,发个新模型给大家过节固然不错;要是还差点火候,总不能为了凑热闹,把没做好的模型硬端上桌。
而且,如今的大模型,想要再给大家来一点令人眼前一亮的升级并不容易。尤其是旗舰模型,参数继续增加、训练继续加码,最终还得落实到实打实的能力提升上。
海外几家大厂还在轮番刷新排行榜,国内厂商要是拿出一款新旗舰,结果跑分没涨多少,成本倒是上去了,恐怕也很难交差。与其赶在假期前发布一款没有多少惊喜的新模型,不如再攒一攒,厚积而 " 后发 " 嘛。
还有一种可能是,模型厂商现在要操心的事情,实在太多了。
前面提到的 DeepSeek 就是个例子。虽然 V4.1 Pro 没来,但 DeepSeek Harness 十一可没歇着,国产算力的底层工具也在加紧完善。
互联网大厂那边,似乎也在准备一场新的竞赛。
Muse 爆火之后,个人 Agent 成为了最受关注的赛道,眼看着海外厂商已经开始给 Agent 安排工位、配联系方式,甚至组建团队,国内互联网大厂自然也有自己的盘算。十一前,腾讯 Handy Bot、字节 Spell 接连被曝光,阿里千问也已经明确了个人 Agent 方向。
或许,国内 AI 厂商的竞争重心正在向 Agent、产品和商业化转移一部分。这未必是坏事,毕竟模型最终要有人用,也要有人愿意付钱。
但模型能力终究还是智能的基础。放眼海外,Claude、GPT、Gemini、Grok 还在轮番更新,模型能力和产品形态都在往前走。
如果说此前国内大模型凭借快速迭代和极致性价比,逐渐追上了全球第一梯队,那么现在,最需要警惕的就是好不容易追上的距离,又被重新拉开。
慢一点没什么问题,但在这个行业,一两个月已经足够创造好几条 " 斩杀线 "。
现在,国内的 AI 工程师们大概也陆续回到了工位。
假期休完了,是时候拿出点新东西了。