分析师/会磊
校对/Tina
策划/Eason
"犯其至难而图其至远。"在一段文言文起手式之后,月之暗面于7月17日凌晨抛出了一则重磅消息——Kimi K3。
这并非一次寻常的版本迭代,而是一个参数规模高达2.8万亿、上下文窗口长达100万token的"巨兽"亮相,并且它承诺将在10天后开源。消息一出,国内社交媒体瞬间沸腾,热搜榜上"Kimi K3"词条迅速攀升,评论区里惊叹与质疑齐飞:有人高呼"国货之光",有人则盯着那比肩GPT-5.6 Terra的API定价倒吸凉气。
然而,这场发布会的真正重头戏发生在大洋彼岸。
当Code Arena前端编程榜单刷新,Kimi K3以1679分力压Claude Fable 5登顶全球第一时,硅谷的睡意被彻底驱散。
一向直言不讳的马斯克在X上留下"Impressive"的评论,OpenAI高管出面质疑开源策略,费城半导体指数应声下挫。
一个中国创业公司的模型发布,为何能同时刺痛硅谷与华尔街?这头被月之暗面放出的开源巨兽,究竟改变了什么?
参数只是一张入场券,硬核实力才是真章
要理解这场风暴的源头,得先拆解Kimi K3这颗"芯"。
首先映入眼帘的是一连串令人眩晕的数字:2.8万亿总参数,使其成为全球首个开源的3万亿级别模型。但规模仅是表象,关键在于它如何驯服这头巨兽。
官方披露的技术架构显示,K3基于Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(注意力残差)技术构建。
通俗地说,前者确保模型在处理超长序列(如整部小说代码库)时不被计算量拖垮,后者则让信息在深达数百层的网络中传递时不至于"失忆"。两者结合,撑起了万亿参数的高效运转。
与此同时,K3采用了Mixture of Experts(MoE)稀疏架构,在896个专家中仅动态激活16个。配合Stable LatentMoE框架和训练数据配方的优化,其整体扩展效率相比前代K2提升了约2.5倍。这意味着,同样的算力投入,K3能"榨出"更多的智能。在权威的Artificial Analysis智能指数评分中,K3拿下57分,稳居全球第三,身前只剩Claude Fable 5和GPT-5.6 Sol两座大山。
然而,真正让开发者圈层沸腾的,是其"长程编程"与"原生多模态"能力的结合。官方展示的案例极具冲击力:在GPU内核优化竞技场中,K3能在24小时内自主完成内核重写与分数验证,表现接近Fable 5;它甚至从零构建了一款名为MiniTriton的紧凑编译器,性能比肩业界成熟的Triton。
更令人惊叹的是,K3能将3D推理、编程与视觉能力融会贯通,无论是复刻黑洞卡冈图雅的视觉特效,还是设计一款4mm的芯片并完成时序收敛,亦或是花两小时复现一篇天体物理论文的计算流程,它都展现出了超越"聊天工具"范畴的Agent生产力。
简而言之,K3不再是一个只会生成代码片段的"实习生",而是一个能独立完成复杂工程项目的"全栈工程师"。
风评逆转与降维定价:
当"蒸馏论"失效,价格体系崩塌
Kimi K3发布后,国内舆论场出现了一个耐人寻味的现象——关于"蒸馏"的质疑声几乎消失了。
过去,每当国产大模型取得突破,总会被部分声音简单归结为"靠蒸馏偷师"。但这一次,K3用2.8万亿参数的自研架构和Code Arena第一的硬成绩,让这种万能解释彻底失效。
如果靠蒸馏就能轻松超越Claude Fable 5和GPT-5.6 Sol,那全球AI格局为何仍是中美双雄会?舆论风向的转变,标志着国产模型从"追赶者"开始被重新审视。
而在大洋彼岸,资本市场用真金白银投下了更为震撼的一票。
K3发布后,全球半导体股票抛售加剧,费城半导体指数单周表现创下近一年来最差。高盛将此次下跌定性为"去杠杆事件",并明确指出:问题不在于Scaling Law失效,而在于单纯扩大预训练算力已不再是通往领先模型的唯一路径。
当K3用架构创新证明"力大砖飞"和"巧劲"可以并存时,市场开始重新评估存储、芯片设备乃至整个数据中心的利润增长预期。
这种恐慌的根源,在于Kimi K3的定价策略精准地刺破了闭源模型的溢价泡沫。
对比来看,K3的API输入(缓存未命中)和输出价格分别为每百万token 20元(约3美元)和100元(约15美元),仅为Claude Fable 5的20%,Opus 4.8的40%。借助Mooncake分离式推理架构,编程场景缓存命中率超90%,实际输入成本再打四分之一。
当开源模型以十分之一的成本提供接近甚至局部超越闭源旗舰的能力时,Anthropic和OpenAI赖以为生的"技术护城河+高价订阅"模式,第一次出现了松动的裂痕。
行业分水岭:从"拼算力"到"拼效率",
闭源阵营的定价权松动
Kimi K3的发布,绝不仅仅是一次产品迭代,它已然成为全球AI行业的一个标志性分水岭。
首先,它宣告了"纯堆算力的预训练竞赛"进入下半场。
过去几年,行业陷入"参数越大越好"的内卷,疯狂采购英伟达GPU。K3的出现证明,通过模型架构创新(KDA/AttnRes)、训练方法优化(量化感知训练、专家并行)和数据质量提升,同样可以获得质的飞跃。
这对于算力受制、融资环境趋紧的中国AI公司而言,指明了一条更具可持续性的道路——从拼资本转向拼智商(算法效率)。
其次,它彻底动摇了"闭源即护城河"的投资逻辑。
过去两年,支撑OpenAI、Anthropic高估值的故事基石是:只有我能造出最聪明的模型,你想用就得付高价。K3开源后,全球中小企业和开发者无需向闭源厂商缴纳高额订阅费,就能拿到一个接近顶级水平的模型底座自己部署。
当开源模型的能力追到闭源模型的90%,而成本仅为后者的20%时,闭源厂商的定价权便开始不可逆地松动。华尔街真正焦虑的,正是这种定价权的转移。
而Kimi K3这次的定价策略,用一句话概括就是:以"性能对标海外旗舰、价格锚定国产天花板"的姿态,推动中国大模型从"低价内卷"走向"价值变现"。
先看一组硬核数据对比。据月之暗面开放平台官方公示,K3的API定价为:输入20元/百万token(缓存未命中)、2元/百万token(缓存命中),输出100元/百万token。换算成美元,即输入3美元、输出15美元。横向对比海外旗舰:Anthropic官网显示,Claude Fable 5定价为输入10美元、输出50美元;OpenAI的GPT-5.6 Sol则为输入5美元、输出30美元。K3的标价大约是Fable 5的三分之一、Sol的六成。
再看国内,差距更为悬殊。高盛研报显示,K3混合收费约2.3美元/百万token,显著高于阿里Qwen3.7 Max的1.4美元、智谱GLM-5.2的0.9美元、MiniMax M3的0.22美元及DeepSeek V4 Pro的0.18美元。智谱GLM-5.2的输入和输出价格分别为1.4美元和4.4美元,K3的输出价格约是其3.4倍。相比自家前代,K3的API输出价格较K2.6涨了超3.5倍。
那么,Kimi K3凭什么敢定这个价?
第一,性能撑腰。在Frontend Code Arena前端编程盲测中,K3以1679分登顶全球第一,超越Claude Fable 5(1631分)和GPT-5.6 Sol(1618分)。在Artificial Analysis智能指数中,K3以57分位列全球第三。
摩根士丹利指出,K3证明中国大模型在规模、性能和定价三个维度同时实现了对美国头部厂商的全面追赶。
第二,成本有底。高定价不等于高成本。月之暗面披露,依托自研Mooncake分离式推理架构,K3在编程场景下缓存命中率超90%,企业用户实际输入成本仅为标价的四分之一。Artificial Analysis测算,K3单任务平均调用成本约0.94美元,与GPT-5.6 Sol(1.04美元)基本持平,仅为Claude Opus 4.8的一半。
第三,战略卡位。这不是一次简单的涨价,而是一场精心设计的"定价权争夺战"。
高盛将K3定价定性为"创国产模型新高",摩根士丹利则将其定义为国内大模型行业"定价回归"的标志性信号——终结过去两年国产模型靠低价换流量的内卷模式,推动赛道从"烧钱换量"转向"性能变现、反哺研发"的正向循环。市场用真金白银投了赞成票:发布仅48小时,Kimi便因算力紧缺暂停C端新用户订阅;月之暗面市场份额自发布前的1.6%跃升至7.9%。
最后,它重塑了全球AI竞争的心理格局。马斯克的点赞与OpenAI的质疑,构成了一个有趣的镜像:前者将其列为对手,后者则感受到威胁。
从"望尘莫及"到"望其项背",中国AI不再仅仅是"性价比之选",而是开始成为技术前沿的定义者之一。
开源世界的"K3时刻":
智能普惠,不止于一句口号
尽管Kimi K3在复杂推理和用户体验上与Claude Fable 5、GPT-5.6 Sol仍有肉眼可见的差距,但它最大的贡献或许在于重新点燃了开源社区对"顶级模型"的想象。
过往,开源模型往往扮演着"追赶者"的角色——闭源出什么,我用更低的成本复现。
而K3选择了一条更艰难的路:主动将参数规模推向新上限,挑战百万上下文、长程Agent等下一代能力边界,并承诺7月27日完整开源。
这种"能力上探、价格下探、代码公开"的组合拳,让全球开发者,尤其是那些资源受限的研究机构与全球南方国家,得以平等地站在智能时代的起跑线上。这恰好与2026年世界人工智能大会发布的"开源开放是人工智能普惠发展重要路径"的主席声明形成了呼应。
当然,挑战依然尖锐。K3并非完美,官方坦诚其存在"对历史思考内容敏感"、"过于主动"等局限性,且当前算力资源已因用户激增而告急,甚至开启了会员限购。
此外,高定价能否被C端普通用户接受,企业级客户是否愿意为"开源模型"的长期稳定性和安全性买单,仍需市场验证。
但无论如何,Kimi K3已经用实力撕开了一道口子:它证明了在通往AGI的征途上,中国力量不仅能"跟跑",更能"并跑",甚至在特定赛道上"领跑"。
当技术的壁垒被一行行即将公开的代码瓦解,当知识的火种在全球开发者手中传递,一个真正共创共享的智能时代,或许才真正有了开始的形状。
转载、采访报道:Tina(微信:beijingyh1992)
榜单、市场合作:小新(微信:dyxsmxx)
研究报告合作:Kim(微信:beijingkim2020)
商务合作:Sherry(微信:sherry_199909)
视频合作:Rita(微信:qyqx20220202)
更多内容
【人工智能】3.45亿 VS 1.66亿:豆包逼急阿里,千问携40亿淘宝商品库打响"AI购物第一枪"|一觉醒来,马斯克亲手解散xAI!22万张GPU全给Claude,AI战局一夜改写|68元起,豆包迈向收费第一步:免费的"代价",终于兜不住了|Anthropic"连坐"封号、Cursor 9秒删库:AI反噬企业的惨痛一课,代价太贵了|阿里"快乐小马"开启灰度测试:用原生音画定义AI视频的下半场|每秒10米、无头无手、重心贴地:宇树H1如何让机器人"飞"起来?|腾讯扔出一只浏览器"龙虾",浏览器赛道迎来最强搅局者|"太危险了,不敢公开发布":Claude Mythos为何让硅谷巨头集体恐慌|字节、阿里、腾讯的AI工业化暗战:谁在建造AI时代的"工厂"?|从工具到生态:银联APOP框架发布,勾勒智能体支付新蓝图|日均120万亿Token,中国大模型终于跑出一个"全球第三"|Claude Code"被开源":一场51万行代码的意外漂流,正在加速AI开发者的竞赛|没等来V4,等来大升级?Deepseek宕机一夜,是重大事故还是偷偷变强|从偏科生到"人形第一股":王兴兴的十年逆袭|亲手砍掉Sora,奥特曼在下一盘什么棋?|龙抬头,向AI"抬头":一部AI短剧如何"捅破"传统广告的天花板|Token经济:谁在瓜分"小龙虾"带来的万亿红利?|谷歌AI Studio深夜放大招:全栈Vibe编码体验上线,一句话开发原生应用
【行业深度】具身智能"爆发",谁将是背后的"投资之王"?|AI会革了百度的命吗?|真假混战:Agent元年,如何拨开概念迷雾?|没找到刚需:人形机器人是个好生意吗|用得起来 还有"人样" 2025世界机器人大会人满为患|2025年WAIC:一票难求,800厂商从"概念"走向"落地"|AI浪潮下,数据库如何"进化"?|AI Agent是中国SaaS的解药|央国企的AI征途:抢跑还是稳行?|出走大厂的95后CEO们,已在AI赛道融资数亿|这波AI风口,让青年投资人踩中了|深圳实验创投"群英谱":一所中小学的"硬核"造星之路
【人物周刊】中台化架构+场景化落地:迈富时如何用AI-Agentforce构建企业"智能业务闭环"?|行业困于"伪智能",原力无限以VLA与世界模型双线破局|从技术先锋到生态构建者,贝锐CEO讲述19年"连接革命"与"软硬一体"突围之路|一群清华人,与具身智能的四十年|用AI Agent征战海外市场|Agent让营销从"人找货"变"货追人"|专访白惠源:撕掉"阿里副总裁"标签,数亿资金押注"下一代AI"|姚期智和他的"姚班":人生只为一大事而来|朱啸虎:萧条时代下的迷途猎手|雷军和他的"小米哲学":把风口玩到next level
【行业研究】《2025年中国企业级AI Agent应用实践研究报告》|《2025年中国金融业数据库国产替代能力评估报告》|《大模型时代 2025年央国企数智化转型新实践与新范式》|《2025年中国IT后市场发展研究报告》|《2024年央国企RPA市场研究报告》|《2024年中国AI大模型产业发展与应用研究报告》|《2024年中国银行业数据库市场研究报告》|《2024年中国CRM市场研究报告》|《2024年中国智能客服市场研究报告》|《2024年中国网络靶场市场研究报告》|《2024年中国交通运输行业数字孪生市场研究报告》
关注「第一新声」并设置星标,第一时间GET行业信息