跳转到主要内容

中国首个2万亿参数AI模型运行在阿里云新型超级节点上

阿里云正式推出了其最新的超级节点实例——灵骏真武M890,标志着中国大规模AI训练和推理的一个重要里程碑。首批已在乌兰察布地区开售,这是国内首个成功运行超过2万亿参数大模型的节点。

是什么在驱动它?来自T-head的下一代真武M890 AI芯片,支持从FP32到FP4的多种数据精度。结合ICN Switch 1.0互连芯片,实现了64张卡之间800GB/s的高速连接,内存池达9TB。这足以处理大规模MoE模型的专家并行需求。

目前,像Kimi K3和阿里自家的Qwen3.8 Max(参数规模高达2.4万亿)等知名模型已在该实例上运行。性能提升显著:在智能驾驶和具身智能等训练场景中,比上一代真武810E快达3倍。在Agentic推理方面,性能提升达1.5倍。

最大的优势之一是什么?企业客户无需自建数据中心。他们只需在云上激活高速互连的计算单元即可。单个实例可支持高达100万亿参数的MoE模型推理。

在底层,灵骏真武M890依托统一的灵骏智能计算平台,配备HPN 8.0训练推理一体化网络。其单集群可支持多达13万个异构计算资源,并可灵活扩展至数百万张卡。这为当前AI工作负载的爆炸性增长奠定了坚实基础。

此次发布不仅仅是硬件——它关乎让尖端AI更易获取。通过在云上提供这一超级节点,阿里云降低了企业训练和部署大规模模型的门槛,无需高昂的前期投资。

关键要点

  • 中国首个:成功运行超过2万亿参数的大模型。
  • 硬件:真武M890芯片,支持FP32至FP4精度,800GB/s互连,9TB内存池。
  • 性能:训练场景快达3倍,Agentic推理提升1.5倍。
  • 可用性:现已在乌兰察布地区可用;Kimi K3和Qwen3.8 Max等模型已运行。
  • 可扩展性:单集群支持多达13万个异构计算资源,可扩展至数百万。