关于ZAKER Skills 合作
牲产队 4小时前

豪掷 25.6 亿美元,DeepSeek 大量采购华为芯片?

16 万颗,DeepSeek 被曝将采购大量华为芯片!

彭博社扔出一颗重磅炸弹,DeepSeek 计划豪掷 25.6 亿美元,向华为订购至少 16 万颗下一代昇腾 950DT 芯片,全部部署到内蒙古乌兰察布一座吉瓦级的超大型智算中心。

什么概念呢?AI 圈常说的 " 万卡集群 ",已经是国内一线大厂实力的象征,今年 3 月 26 日,深圳刚点亮全国首个万卡级昇腾集群,DeepSeek 这一单,直接是它的 16 倍。

放到全球,美国科技巨头这几年疯狂堆卡,微软、Meta、谷歌、xAI 动辄十万卡级。这一单真按计划落地,中国将第一次在单集群规模上,拿出一个能跟美国顶级超算掰手腕的全国产芯片集群。

DeepSeek 为什么选昇腾 950DT?

先看现实情况,美国对华 AI 芯片出口管制层层加码,英伟达最先进的卡,根本买不到,就算是 H20 这种 " 特供阉割版 ",也是今天能买、明天可能就断供,脖子随时被人掐着。

国产替代这四个字,到了 DeepSeek 这个量级,已经不是喊口号,而是不得不做的战略选择。

昇腾 950DT 什么来头呢?它是华为昇腾系列,规划在 2026 年第四季度推出的下一代旗舰,早在 2025 年 9 月的华为全联接大会上,徐直军就第一次亮出了三年路线图。

这颗卡,专门为超大规模 AI 的训练和推理解码阶段而生。

先上硬参数,新一代达芬奇架构、微架构升级到 SIMD/SIMT,配上 144GB 的自研 HBM 高带宽内存,访存带宽高达每秒 4TB,芯片间互联带宽每秒 2TB,单颗芯片 FP8 算力就达到 1 PFLOPS。

但话说回来,论单卡硬碰单卡,它跟英伟达最旗舰的产品,仍有差距。这一点,徐直军自己都不回避:受制裁,华为没法去台积电投片,先进制程受制于人,CUDA 那套软件生态,更是人家几十年垒起来的护城河。

单颗芯片想一口吃成胖子,不现实!

那华为怎么破局?思路特别清晰,不跟你拼单卡,拼系统、拼集群。单卡制程差一点,那就用超高带宽互联,把成千上万张卡 " 黏 " 成一台超级计算机,用系统级优势,去补单卡的差距。

Atlas 950 超节点,就是这套打法的集大成者。一个计算柜装 64 张卡,16 个柜子、1024 张卡组成一个超节点,FP8 总算力达到 1 EFLOPS,还拥有 256TB 全局统一内存、3 微秒级超低时延。

什么概念?按理论峰值粗略折算,这么一个超节点,顶上三千张上下的上代 A100。而且,按照华为满配规划,这套架构最大还能扩到 8192 卡。

当然,冷水也得泼。截至目前,昇腾 950DT 既没有量产实测数据,也没有同口径的第三方对比,包括 " 谁代工、几纳米 ",华为官方也从没松过口。是骡子是马,得等真量产、跑起来才知道。

但有一条是确定的,从芯片设计,到 CANN 软件栈,再到服务器、超节点,华为端出来的,是一套完全自主可控的全栈方案,这才是最关键的地方。

这套 " 中国闭环 " 的分量,怎么强调都不过分。

相关标签

相关阅读

最新评论

没有更多评论了
财经新闻

财经新闻

财富解码 纵横投资

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容