阿里云灵骏真武M890超节点实例发布 训练性能提升三倍
的线索投递!算力服务,目前已在内蒙古乌兰察布地域开放邀测。800GB/s。大模型的推理。分离部署需求,并可进一步扩展至百万卡级。的平均可用性,让算力真正被用在训练本身。,增强稳定和安全能力,加速数据传输和存储访问。
算力服务迎来新突破
阿里云于2026世界人工智能大会上, 正式推出了灵骏真武M890超节点实例, 这是其首次于公共云上提供这般超节点形态的服务, 当下该服务已在内蒙古乌兰察布地区开放邀请测试, 此标志着AI算力基础设施迈出了重要一步。
此一举措表明开发者能够更为便利地获取高性能算力, 无需再进行繁杂的本地部署, 借助云端便可调用强大的计算资源, 这对于那些急切需要大规模算力支持的大模型训练团队而言, 无疑是一则极大的利好消息, 降低了技术门槛。
性能指标大幅跃升

灵骏真武M890具备支持FP8以及FP4低精度计算的能力, 这对计算效率具有极大的提升作用。它核心的ICN 1.0芯片, 把Scale-up互联规模由l 6卡提升至64卡。卡间互联带宽达到了令人惊叹的800GB/s, 为高速数据交换铺设了坚实基础。
与上一代的真武810E相较, 这款新型实例于智能驾驶以及具身智能等训练场景里, 其性能实现了升高了至三倍。这意思就是, 相同的任务可以于更短暂的时间段内被完成, 明显地加快了发展革新速度, 对于企业更快地夺取在市场中的领先之境遇有帮助。
大模型推理能力增强
依靠超大显存以及全对称高速互联技术, 单个超节点实例便能承担住十万亿参数级别的MoE大模型推理。这对运行超大规模语言模型而言极其关键, 化解了以往因受硬件资源局限而不能畅快运行的难题。

对于用户而言, 再也不用去担忧因显存欠缺所引发的中断情况了。这样的一种设计, 致使复杂模型能够达成实时响应, 为多重高端AI应用场景铸就了稳固的支撑保障。不管是金融风控领域, 还是医疗诊断范畴, 均能够获取更为精确、更为快速的结果予以支持。
网络架构全面升级
依据 HPN 8.0 训推一体高性能网络架构, 智算灵骏单集群所支持的异构算力混布, 在最高程度上可达 13 万张卡。它对 PD 分离部署需求同样予以支持, 在未来能够向着百万卡级别作进一步扩展。这种具备弹性的扩展能力, 满足了不同规模企业的需求。
前端网络运用了 CIPU 2.0 架构, 其表现为之增强稳固性以及安全性的层面, 并且加快数据传达以及存储访问的速度。于后端存储这个范畴来讲, 借由飞天盘古予以重新构建的 CPFS达成了数据面同控制面相分离的状况, 单一的文件系统能够支持百 PiB 的容量以及百 TB/s的吞吐能力。
高可用性保障业务
阿里云借助实例故障主动监控, 还有分钟级故障自恢复机制, 进而保障了平均可用性达到99.7%, 这使得开发者能够把精力聚焦于算法优化方面, 而非耗费大量时间去处理诸如服务器宕机这类问题, 算力的稳定性乃是AI应用落地所必需的关键前提条件。

这样的高可用设计显著地削减了业务中断的风险, 对于追求连续性以及实时性的AI服务来讲, 稳定的算力环境恰似有着如生命线一样的重要性, 它确保了模型训练不会由于硬件故障而导致前功尽弃, 还提高了整体投资回报率。
行业影响深远
这次所发布的, 是M890超节点实例, 它预示着进入AI算力服务的, 是迎来一个新阶段, 它不但提升了单次计算的性能, 而且借助云化服务, 让触手可及的是优质算力这部分内容是另外一个点, 这会达到加速各行各业智能化, 转型步伐此项内容从而推动技术创新普及的效果。
日后, 伴随更多区域的放开以及规模的扩充, AI应用的界限将要持续延展。我们憧憬目睹更多基于此算力平台问世的创新产物。你觉得这项技术会怎样去变更未来的AI开发方式? 欢迎留言探讨。