阿里云超节点成功适配2.4万亿参数旗舰大模型

发布时间:2026-07-23 17:21

  今日,阿里云宣布灵骏线 超节点实例已成功适配 Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行

  据介绍,Qwen3.8 是阿里最新旗舰模型,参数规模高达 2.4 万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的 GPU 卡,让万亿参数“跑得又稳又快”。然而,普通 AI 集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。

  线 是平头哥新一代训推一体 AI 芯片,原生支持 FP32 到 FP4 等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。灵骏线 超节点实例通过 ICN Switch 1.0 互联芯片,让 64 张线GB/s 的高速互联,显存规模达到 9TB,单实例即可支撑大规模2 万亿参数 MoE 模型的专家并行需求。

  此外,阿里还从芯片到云平台层面实现了与 Qwen 模型的全链路优化,不仅可以丝滑跑通 Qwen3.8,还能显著提升推理效率、降低推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在 Agentic 推理场景中最多可实现1.5 倍的推理性能提升。

排行

精选