IT 之家 2 月 5 日消息,AI 推理芯片初创企业 Positron 当地时间公布了其第二代 ASIC 设计 Asimov,宣称该产品的 Token 能效与性价比都可以达到英伟达 Rubin GPU 的五倍。
Positron 表示 Transformer 推理运行的限制在内存而非算力,因此 Asimov 在设计上就是以内存优先,拥有 90% 的内存带宽利用率,并从结构上消除不必要的远程数据移动。

Positron Asimov 支持多样化拓扑结构的 16Tbps 芯片间互联。其 Titan 推理服务器系统采用 19 英寸 4U 机架规格,聚合了 4 颗 Asimov 芯片,支持 16T 参数模型推理和 10M 上下文窗口,单系统最多 4096 套 Titan。
