阿里云灵骏真武M890超节点适配Qwen3.8,为超万亿参数大模型运行提供新支撑

   发布时间:2026-07-23 16:10 作者:唐云泽

阿里云近日宣布,其自主研发的灵骏真武M890超节点实例已成功适配并运行参数规模达2.4万亿的Qwen3.8大模型,成为国内首个实现超大规模模型稳定运行的超节点系统。该成果标志着我国在AI算力基础设施领域取得重大突破,为万亿参数模型的商业化应用提供了关键技术支撑。

作为阿里最新一代旗舰模型,Qwen3.8的参数规模较前代增长近一倍,其运行需要将模型参数分散至数十乃至上百张GPU卡协同工作。传统AI集群受限于通信带宽,难以满足这种规模模型对高吞吐、低延迟的严苛要求。阿里云通过架构创新,成功解决了这一技术难题。

灵骏真武M890超节点的核心突破在于其革命性的互联架构。该系统采用平头哥自主研发的ICN Switch 1.0互联芯片,将64颗真武M890芯片实现800GB/s的极速互联,构建起显存规模达9TB的统一计算池。这种设计使得单实例即可支持2万亿参数MoE模型的专家并行计算,无需跨节点通信即可完成模型推理。

真武M890芯片作为新一代训推一体AI芯片,原生支持从FP32到FP4的多精度计算,可灵活适配高精度训练与低精度推理的不同场景需求。阿里云工程师透露,通过芯片级指令优化与云平台资源调度算法的深度协同,系统在保持2.4万亿参数模型稳定运行的同时,将推理成本降低了40%以上。

实测数据显示,在Agentic推理等复杂场景中,该超节点通过算子融合、内存优化等软硬件协同技术,实现了最高1.5倍的推理性能提升。这种全链路优化不仅体现在计算效率上,更通过智能调度算法将GPU利用率提升至92%以上,显著优于行业平均水平。目前,相关服务已通过阿里云百炼平台对外开放,企业用户可直接调用这一超强算力资源。

 
 
更多>同类内容
全站最新
热门内容