关于ZAKER Skills 合作
星途科讯 刚刚

AMD 发布 Ryzen AI Max PRO 400:192GB 显存赋能本地大模型

在柏林举行的 IFA 2026 开幕主题演讲中,AMD 正式发布了代号为 "Gorgon Halo" 的 Ryzen AI Max PRO 400 系列处理器。该平台凭借片上充足的统一内存,实现了 x86 笔记本芯片的重大突破:无需连接云端或独立显卡,即可在本地运行参数量超过 3000 亿的 AI 模型,且敏感数据无需传出设备。

160GB 统一显存重构本地 AI 边界

Ryzen AI Max PRO 400 的核心优势在于其架构设计:CPU 与 GPU 共享同一芯片上的 192GB LPDDR5X-8533 内存池,其中高达 160GB 可分配给集成 GPU 作为显存(VRAM)。这一数值远超任何独立笔记本显卡,且内存池以约 273 GB/s 的速度运行,彻底消除了 PCIe 传输带来的性能瓶颈。

本地运行大型语言模型(LLM)的主要瓶颈在于内存容量与带宽,而非算力。传统笔记本独立显卡通常仅配备 8 – 24GB 显存,难以加载 700 亿参数以上的模型。即便采用 4 位量化技术,700 亿参数模型仍需约 38 – 40GB 空间,超出大多数便携硬件极限。而 AMD 的 3000 亿参数宣称基于 4 位量化精度:3000 亿参数约占 150GB 存储空间,在 160GB VRAM 中留有约 10GB 余量用于关键值缓存,这在理论上是可行的。

相比传统系统中通过 PCIe 总线传输数据(Gen 4 × 16 实用带宽约 32 GB/s),Gorgon Halo 的统一内存架构让 CPU 和 GPU 访问相同的物理地址空间,无需数据复制。尽管 273 GB/s 的带宽低于数据中心级 HBM3 加速器,但对于便携式设备的推理任务而言,足以以可用的速率流式传输大型量化模型权重。

产品阵容:旗舰升级,其余延续

AMD 此次推出三款处理器,但仅最高端型号在计算硅片上有所提升,其余两款主要受益于内存系统的刷新。

Ryzen AI Max+ PRO 495:拥有 16 个 Zen 5 核心(32 线程),基础频率 3.1 GHz,加速频率 5.2 GHz。集成 Radeon 8065S GPU(40 个计算单元,3.0 GHz),较前代提升 100 MHz。NPU 基于 XDNA 2 架构,算力达 55 TOPS。总缓存 80MB,TDP 范围 45 – 120 瓦。

Ryzen AI Max PRO 490:12 核心 24 线程,基础频率 3.2 GHz,加速频率 5.0 GHz。集成 Radeon 8050S GPU(32 个计算单元),NPU 算力 50 TOPS。总缓存 76MB。

Ryzen AI Max PRO 485:8 核心 16 线程,基础频率 3.6 GHz,加速频率 5.0 GHz。同样配备 Radeon 8050S GPU 和 50 TOPS NPU。总缓存 40MB。

所有型号均支持多达 192GB LPDDR5X-8533 统一内存及 160GB VRAM 分配。490 和 485 型号的 GPU 与 NPU 架构与前代 Strix Halo 相同,变化仅在于内存控制器。目前 AMD 仅确认了 PRO(企业 / 商用)版本,消费版尚未公布。

竞品对比:内存优势显著,生态仍有差距

Ryzen AI Max PRO 400 直面 NVIDIA 日益激烈的竞争。NVIDIA 的 DGX Spark(桌面个人 AI 计算机)和即将推出的 RTX Spark(消费级笔记本 / 台式机芯片)均采用 ARM CPU 搭配 Blackwell GPU,提供 128GB 统一内存。相比之下,AMD 在内存容量(192GB vs 128GB)和 VRAM 分配上占据明显优势。

然而,在训练工作负载方面,NVIDIA 凭借 Blackwell 架构专用的 FP4/FP8 稀疏加速张量核心,以及成熟的 CUDA 软件生态系统,仍具有显著优势。对于需要在设备上微调或训练模型的开发人员,NVIDIA 平台更具吸引力。但对于主要关注推理、代理型 AI 工作流及设备端数据处理的用例,AMD 的大内存配置更为合适。此外,AMD 的 x86 架构确保 Windows 遗留软件和企业应用能原生运行,无需依赖模拟层。

供应链警示:DRAM 短缺或影响出货

尽管硅层面规格真实,但 192GB 配置的量产面临严峻的供应链挑战。受 AI 基础设施需求激增影响,全球 DRAM 短缺在 2026 年加剧,LPDDR 合同价格同比上涨约 146%。苹果此前因内存模块供应限制而取消高配 Mac Studio 配置,正是由于缺乏 SK 海力士的 24GB LPDDR5X 封装——这也是 AMD 192GB 配置所需的关键组件。

因此,虽然 AMD 确认惠普和联想将在 2026 年第三季度(9 月底前)推出搭载该芯片的商用系统,但 192GB 配置的具体定价和可用性仍存变数。潜在买家需密切关注 OEM 的最终定价与供货情况。

可用性与生态兼容

AMD 确认,Ryzen AI Max PRO 400 驱动的商业系统将涵盖商用 AI PC、移动工作站和紧凑型小型台式系统。惠普和联想为首批合作伙伴。此外,面向开发者的 Ryzen AI Halo 紧凑型台式机(基于前代架构)已于 2026 年 6 月在 Micro Center 独家预售,预计晚些时候将推出基于 PRO 400 系列的更新版。

在软件兼容性方面,该平台支持 PyTorch、vLLM、llama.cpp、Ollama、ComfyUI 和 LM Studio 等主流 AI 框架,并为 Linux 提供 AMD ROCm 优化。得益于 x86 架构,为标准环境编译的应用程序可原生运行,无需 ARM 模拟。

常见问题解答

真的能在笔记本上运行 3000 亿参数模型吗?

技术上可行,但有前提:必须使用 4 位量化,且占用约 150GB VRAM。目前尚无量产硬件的独立基准测试结果,实际吞吐量待系统发货后验证。

与 Strix Halo(300 系列)有何不同?

主要区别在于内存:400 系列支持 192GB LPDDR5X-8533(300 系列为 128GB LPDDR5X-8000),VRAM 分配上限从 96GB 提升至 160GB。仅旗舰 495 型号有轻微的 GPU/CPU 频率提升,其他架构保持不变。

192GB 配置能否买到?

受全球 DRAM 短缺及价格上涨影响,192GB 配置的供应存在不确定性。AMD 已确认 Q3 出货,但未公布具体定价。建议买家密切关注后续 OEM 公告,不要假设高配版本能轻易以合理价格购入。

【星途科讯 图文丨小林 首发于 ZAKER 科技,转载请注明出处】

星途科讯

星途科讯

解码海外,科技新知

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容