关于ZAKER 合作
IT之家 22分钟前

Positron 公布推理芯片 Asimov,宣称能效可达英伟达 Rubin 五倍

IT 之家 2 月 5 日消息,AI 推理芯片初创企业 Positron 当地时间公布了其第二代 ASIC 设计 Asimov,宣称该产品的 Token 能效与性价比都可以达到英伟达 Rubin GPU 的五倍。

Positron 表示 Transformer 推理运行的限制在内存而非算力,因此 Asimov 在设计上就是以内存优先,拥有 90% 的内存带宽利用率,并从结构上消除不必要的远程数据移动。

Asimov 芯片由一对计算模块组成,内置支持多样化数据格式的脉动阵列。每个计算模块连接到 432GB 的 LPDDR5x 内存,并通过 PCIe 6.0 / CXL 3.0 连接到至多 720GB 的 KV Cache 缓存用内存。其芯片整体 TDP 为 400W,内存总容量 2304GB、总带宽 2.76 TB/s,支持风冷冷却。

Positron Asimov 支持多样化拓扑结构的 16Tbps 芯片间互联。其 Titan 推理服务器系统采用 19 英寸 4U 机架规格,聚合了 4 颗 Asimov 芯片,支持 16T 参数模型推理和 10M 上下文窗口,单系统最多 4096 套 Titan。

Positron 表示 Asimov 芯片目标在 2026 年底完成芯片流片,并在 2027 年初投入生产

相关标签

相关阅读

最新评论

没有更多评论了
IT之家

IT之家

数码,科技,生活

订阅

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容