关于ZAKER Skills 合作
红星新闻 14小时前

“月之暗面”发布 Kimi K3 火爆全球,美国羡慕又不甘:预测投入是中国的 8 倍,为什么仍是中国公司先做出来

北京时间 7 月 17 日凌晨,月之暗面公司发布开源大模型 Kimi K3。据报道,该模型总参数规模达 2.8 万亿,是目前全球最大的开源模型,能处理文字和图像,重点面向编程、知识工作和智能代理任务,发布即可通过应用和 API 调用,完整模型权重计划于 7 月 27 日前公开。

发布 24 小时内,K3 在大模型竞技场(Arena)的前端编程匿名测试中登顶,开发者对它的偏好超过 Anthropic 的 Claude Fable 5 和 OpenAI 的 GPT-5.6 Sol。在独立评测机构 Artificial Analysis 的智能指数上,K3 综合排名全球第三。

评测平台 Arena 的联合创始人兼首席执行官阿纳斯塔西奥斯 · 安杰洛普洛斯表示,Kimi K3 的推出 " 可能是今年最大的一次发布 ",它标志着开源的中国模型开始超过美国的闭源模型," 更多结果正在陆续出来,很可能继续显示它处在第一梯队的顶端。"

▲人们在上海世界人工智能大会参观月之暗面的 Kimi K3 展台

马斯克从称赞到对标

美国开发者把系统模型换成 K3

K3 登顶后,反应最先出现在美国开发者圈子里,有人把系统里的模型换成 K3,有人当天就开始拿它搭产品。

Kimi K3 发布当天,特斯拉首席执行官埃隆 · 马斯克在一则评测帖文下留言:"Impressive(令人印象深刻)。"

两天后,马斯克公布下一代 Grok 的训练进展时,把 Kimi K3 列为目标,称新模型 " 或许能够 " 超过 Kimi K3。

月之暗面回应:" 欢迎加入超 2 万亿俱乐部。"

Dropbox 前首席技术官、South Park Commons 合伙人阿迪蒂亚 · 阿加瓦尔在发布当天写道,他正在把公司系统里的 Fable 模型换掉。

Vercel 创始人兼首席执行官吉列尔莫 · 劳赫在 7 月 16 日发布的评测中写道,K3 在 Next.js 网页工程测试中的表现超过 Fable,以更短时间获得了接近的成功率。他称,这是开放模型首次在这套综合网页工程测试中领先所有闭源模型。

美国科技记者马克斯 · 温巴赫让一群 Kimi K3 的代理在浏览器里重建 macOS 27,连拟真界面和原生应用一起做,跑了三个小时,一次任务用掉他当月 60% 的 Kimi 额度。前 AMD 显卡业务负责人、英特尔前高级副总裁拉贾 · 科杜里提到,K3 在一次 48 小时的自主运行里,用开源工具设计、优化并验证了一款芯片。

有开发者展示了一个结合多种玩法的游戏。据他的帖文,K3 使用约 60 万 token 完成这个项目,API 费用为 3.24 美元;相同 token 用量如果使用 Fable 5 和 GPT-5.6 Sol,费用分别为 10.80 美元和 6 美元。Kimi 官方账号随后转发了该项目。

评测和项目展示发布后,用户访问量继续增加。据月之暗面发布的信息,K3 上线 48 小时后,用户请求量逼近现有集群的承载极限,公司暂停面向个人用户的新订阅。企业业务负责人黄震昕表示,团队此前做过流量预案,但实际需求仍超出预期,因此优先保障付费客户,并临时限制新用户。

在匿名测试、独立评测和访问量数据陆续公布后,Mozilla 首席技术官拉菲 · 克里科里安称,美国 AI 实验室 " 明显感到担忧 "。

美国投入近 1 万亿美元

总统科技顾问仍说:这样会输掉竞赛

在围绕 Kimi K3 的一轮讨论中,纽约大学名誉教授、AI 行业评论者加里 · 马库斯转发了一张中美 AI 投入对比图,并写道:"(美国)国会应该调查。认真调查。"

高盛图表显示,2027 年美国主要云服务商的资本开支预计接近 1 万亿美元,约为中国预测投入的 8 倍。

美国分析人士指出,美国拥有更多先进芯片、更大的数据中心预算,中国公司却用小得多的算力做到了逼近前沿。如果中国 AI 实验室能够以较低成本接近美国模型的表现,美国接近 1 万亿美元的基础设施投入将更难解释。

闭源模型可以对每一次调用收费,还能控制安全规则、用户入口和价格,开放模型的变现路径要曲折得多。

开放模型通常还要靠更低的价格换取开发者采用,但 K3 没有被贴上低价标签。据报道,它的 API 每百万输出 token 定价 15 美元,高于月之暗面上一代模型的 4 美元,也高于部分开放权重同行。

在完成一项具体任务的综合成本上,据 Artificial Analysis 测算,K3 约 0.94 美元,接近 GPT-5.6 Sol 的 1.04 美元,约为 Claude Opus 4.8(1.80 美元)的一半。美国银行研究分析师的一份报告也给出同一方向的判断,表示 K3 是迄今定价最高的中国 AI 模型,但仍只有 GPT-5.6 Sol 的一半。

黄震昕说,Kimi 的商业模式对标海外成熟头部 AI 企业," 开源模型、中国大模型不该被贴上低价标签。我们做出了 SOTA 级模型,也能匹配合理的商业定价。"

关于 Kimi K3 的评测结果也进入了美国政策顾问的讨论。美国总统科技顾问委员会联席主席戴维 · 萨克斯称,K3 登上前端编程榜首 " 令人担忧 "。他还指出,这是第一次有中国模型拿下编程头名。他随后列出美国正在给自己增加的阻力,包括阻挡数据中心建设、叠加州级监管、推动前沿模型发布前审批程序," 这就是输掉 AI 竞赛的方式。" 萨克斯写道。

当地时间 7 月 21 日,美国财政部长贝森特公开谈到中国开源模型。他表示,美国政府将审查有代表性的中国模型。

美国追问:

为什么先做出来的是一家中国公司

政策讨论之外,美国人也在追问,为什么先走这一步的是一家中国公司。美国投资人、学者和媒体的讨论主要集中在三个方面。

第一类答案,美国头部实验室不愿放弃已经建立起来的闭源生意。

美国风险投资机构 Benchmark 合伙人比尔 · 格利写道:" 开放前沿已经不再只是一个中国故事。" 他认为,AI 经济中的几乎所有参与者都有理由偏爱开放的基础模型," 只有大型既有企业 Anthropic 和 OpenAI 例外,它们的命运取决于维持封闭 "。

第二类答案,美国施加的芯片限制迫使中国公司把更多工程投入放在技术突破和发明上。

美国限制中国获得先进 AI 芯片,本意是拉开算力差距。澳大利亚新南威尔士大学计算机科学家托比 · 沃尔什说,中国公司在芯片受限的情况下仍造出了前沿模型," 人们不禁会想,或许正是这种‘必要’成了发明之母 "。这一点在 Kimi K3 身上似乎有印证,它虽有 2.8 万亿总参数,却采用混合专家架构,处理每个 token 时只激活 896 个专家里的 16 个,靠 Kimi Delta Attention 和注意力残差等结构改动,使整体扩展效率比上一代 K2 提升约 2.5 倍。

第三类答案,人才最终选择在中国创业,美国没能留下杨植麟。

▲月之暗面创始人杨植麟在 2026 年中关村论坛发表演讲(资料图片)

月之暗面创始人杨植麟从清华大学毕业后,在卡内基梅隆大学取得计算机科学博士学位,随后在 Google Brain 和 Meta AI 工作,2023 年回国创办月之暗面。K3 受到关注后,一些美国投资人、创业者和 AI 研究人员发问:如果杨植麟留在美国,结果是否会有所不同?为什么一个在美国顶尖体系里受过训练的研究者,最后在中国组队做出了 Kimi K3?

投资人维诺德 · 科斯拉怪罪美国的移民政策,称它 " 正在吓跑聪明的人才 "。

杨植麟的博士导师、卡内基梅隆大学的鲁斯 · 萨拉霍丁诺夫曾担任苹果的 AI 研究主管。

据报道,K3 发布后,他公开写道:" 这对开源社区是多大的胜利!感觉植麟昨天才从我的实验室毕业。" 他表示,杨植麟实际上有很多个留在美国的机会,也有能力进入苹果这样的大型科技公司,不过,他很早就打算回国创办自己的公司。

红星新闻记者 邓纾怡

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容