跳到正文
硅脉动SiliconMai

阿里云上线64卡灵骏真武超节点实例

首批实例在乌兰察布开售,卡间互联带宽为800GB/s;公司称可承载十万亿参数级MoE模型推理。

硅脉动
阿里巴巴资料图

阿里云8月12日上线灵骏真武M890超节点实例,首批在乌兰察布地域开售。企业客户可以在云端开通64卡高速互联单元,无需自行建设同等规模的机房和集群。

阿里云称,M890最高可承载十万亿参数级混合专家模型推理,并已运行超过2万亿参数的大模型。Kimi K3和Qwen3.8 Max已经通过该实例向外提供服务。这些承载规模和服务案例来自公司,材料没有披露模型运行时实际启用的参数量、吞吐量或单位推理成本。

超节点支持FP8和FP4低精度计算,并使用ICN Switch 1.0芯片把高速互联规模从16卡提高到64卡,卡间带宽为800GB/s。阿里云表示,在智能驾驶和具身智能等训练任务中,其性能相较上一代真武810E提高三倍,但没有给出具体基准、功耗或硬件配置对比。

M890运行在灵骏智算平台上。该平台使用HPN 8.0训练与推理网络,单集群最高支持13万张异构计算卡混合部署,并可继续扩展。把超节点作为云实例出售,使客户能够按项目采购大规模互联算力,也把硬件运维和网络调度交给云服务商。

64卡互联主要解决大模型跨卡通信问题,参数规模越大,对带宽、内存和调度的要求越高。M890已经开始商业销售,但阿里云未公布实例价格、可选计算卡型号、交付容量及与普通GPU实例的成本差异,这些信息将决定企业采用范围。