关于ZAKER Skills GEO服务 合作
星途科讯 1小时前

阿里拟训 10 万亿参数大模型,自研芯片 2027 年量产

阿里巴巴 CEO 吴泳铭在云栖大会上宣布,公司计划训练参数规模达 5 万亿至 10 万亿的 AI 模型,并发布专为满足该算力需求设计的全新 AI 加速器。

该模型预计归属于通义千问(Qwen)系列。目前 Qwen 4 正在训练中,后续的 Qwen 4.5 及 Qwen 5 系列参数规模将达 5 万亿至 10 万亿,约为当前旗舰模型 Qwen 3.8 Max(2.4 万亿参数)的两到四倍。吴泳铭指出,团队正优化模型架构与数据,以支持更复杂、长周期的任务,并在递归自我改进方面取得进展,使模型能识别自身局限、设计实验并生成数据以提升性能。

自研芯片与算力基建

阿里巴巴平头哥半导体部门同步推出下一代 AI 芯片玄铁 V900。该芯片性能是前代 M890 的三倍,可部署于多达 50 万颗芯片的集群中,用于前沿模型的训练与推理,计划于 2027 年第一季度量产商用。此举是阿里构建本土 AI 计算栈战略的一部分,旨在应对获取先进英伟达处理器的限制。

基础设施方面,阿里云计划到 2032 年将全球数据中心容量提升至超过 20GW。吴泳铭表示,基于 M890 的 AI 超节点已能执行超过 2 万亿参数模型的推理任务,全球仅有少数企业具备此项能力。此前演示显示,运行在 M890 上的 Qwen3.7-Max 曾持续工作 35 小时并完成超 1000 次工具调用,M890 云端部署也已用于运行 Qwen3.8-Max 和 Kimi K3 等超 2 万亿参数模型。

【星途科讯 图文丨 LCC 首发于 ZAKER 科技,转载请注明出处】

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容