阿里云灵骏 GP9A 超节点详解:自研真武 M890 芯片、万亿参数 MoE 推理规格对比

简介: 阿里云灵骏GP9A超节点实例,基于自研真武M890P芯片,64卡全互联架构,提供9216GB显存、1024核CPU与18.4TB内存,支持MXFP4/FP8/BF16等多精度,原生兼容主流AI框架,专为万亿参数MoE模型训推、自动驾驶、搜推广及多模态场景优化。阿里云智能计算灵骏官网:https://t.aliyun.com/U/WjA3cK

阿里云灵骏超节点GP9A实例基于自研真武M890芯片,采用超节点架构面向万亿参数规模模型高性能推理设计,实例规格efg3.GP9A(M890P),9216 GB显存、1024核CPU、18.4TB 内存,阿小云分享阿里云灵骏超节点GP9A实例优势、实例规格、网络及应用场景全解析,在阿里云CLUB中心免费领取优惠券。详细参考阿里云智能计算灵骏官网:https://www.aliyun.com/product/lingjun

超节点GP9A实例优势

超节点GP9A实例具有故障自愈、MoE模型训推、高效推理及生态兼容优势:


  • 超节点架构故障自愈:面向 ICN64 超节点架构,支持故障自愈能力,2^n卡持续可用。
  • 万亿参数MoE模型训推:每卡 144 GB 显存,实例 64 卡共 9,216 GB 显存池,承载万亿参数级模型。
  • MXFP4 高效推理:新增 MXFP4 精度,相比 BF16 可提供数倍吞吐提升,适用于 LLM 推理、推荐系统等追求极致吞吐的场景。同时兼容 BF16 / FP16 / FP8 / FP32。
  • 主流生态全兼容:T-Head SAIL™ 软件栈(Interface / SDK / OS 三层架构)全面兼容主流 AI 生态,业务迁移零代码修改。PyTorch / vLLM / SGLang / Megatron-LM / DeepSpeed 开箱即用。

灵骏超节点实例efg3.GP9A

灵骏超节点efg3.GP9A实例适用于万亿参数MoE推理、具身智能、自动驾驶及搜索推荐,灵骏超节点GP9A实例规格对比如下表:

实例 efg2.P16EN (810E) efg3.GP9A (M890P)
芯片代际 真武 810E(PPU 1.1) 真武 M890P(PPU 1.5)
支持精度 FP32 / BF16 / INT8 FP32 / FP16 / BF16 / FP8 / MXFP4
显存容量 1536 GB 9216 GB
CPU 96 核 1024 核
内存 2 TB 18.4 TB
本地存储 15.36 TB NVMe + 960 GB SATA SSD 122.88 TB NVMe
前端网络 400 Gbps 3.2 Tbps
Scale‑up 卡间互联 11.2 TB/s 51.2 TB/s
Scale‑out 实例间互联 1.6 Tbps 12.8 Tbps
每实例 GPU 16 卡 64 卡
最小售卖单元 裸金属(16 卡) 超节点(64 卡 / 8 节点)
开服地域 北京、杭州、上海、乌兰察布 乌兰察布(可用区 D),中卫(规划中)

灵骏超节点GP9A实例适用场景

GP9A实例覆盖从大模型训练到自动驾驶的全场景AI工作负载,可用于高性能推理、自动驾驶、搜推广与多模态及MXFP4 高效推理等使用场景:

  • 高性能推理:原生支持 vLLM、SGLang 推理引擎,自研 HolmesLLM 提供极致加速。支持 PD 分离推理架构,满足不同推理阶段需求。
  • 自动驾驶:已验证兼容 50+ 自动驾驶模型(感知、预测、端到端)环境部署训练与推理。
  • 搜推广与多模态:支持推荐系统、搜索排序、广告模型等核心场景。同时支持视觉-语言模型、图像生成、视频理解等多模态任务。
  • MXFP4高效推理:MXFP4 精度相比 BF16 可提供数倍吞吐提升,适用于 LLM 推理、推荐系统、实时图像处理和自动驾驶等极致吞吐场景。


更多配置信息及精准报价,在阿里云智能计算灵骏官网:https://www.aliyun.com/product/lingjun  查询精准报价。

相关文章
|
1月前
|
机器学习/深度学习 Web App开发 编解码
2026 年 8 月大模型的三重跃迁
8月1—3日,国产大模型密集突破:通义千问Qwen3.8-Max以2.4T稀疏MoE+1M上下文实现高效推理;MiniMax开源全模态视频模型H3,支持2K/15秒带声视频生成;DeepSeek V4-Flash显著提升Agent能力。三大进展分别指向参数效率、长程自治与多模态生产,标志着大模型正从“辅助工具”迈向“端到端自主交付”。
2061 1
2026 年 8 月大模型的三重跃迁
|
1月前
|
存储 弹性计算 安全
阿里云飞天:自研分布式云操作系统,飞天将一个个数据中心变成一台超级计算机!
飞天是阿里云自研超大规模云计算操作系统,以“数据中心为计算机”为核心理念,聚合算力、统一调度百万级服务器,提供EB级存储、300万IOPS、12个9数据可靠性等极致性能与高可用能力;融合CIPU芯片架构,强化安全、网络与IO加速,支撑弹性计算、数据库、大数据、AI等全栈云服务。
135 0
|
2月前
|
数据采集 存储 JSON
基于录音转写与大模型的家装客户概览生成实践
针对家装行业长录音(常超万字)设计客户概览系统:通过语音转写、角色区分、语义分段、结构化事实提取、历史数据融合及多层校验,精准提炼家庭情况、需求、预算、顾虑等关键信息,确保每项结论可追溯、无混淆,赋能销售与设计高效决策。
|
5月前
|
人工智能 安全 机器人
阿里云JVS Claw全面开放:无需邀请码云端”养龙虾“,不需要安装体验OpenClaw,纯免费!
阿里云JVS Claw(“AI龙虾”)是基于OpenClaw打造的开箱即用AI智能体,JVS官网:https://t.aliyun.com/U/IJbaxg 支持云端/本地双模部署,无需邀请码、纯免费体验。它能真正动手执行任务——处理文档、分析数据、抓取网页、运行代码,并通过技能库(ClawHub)持续进化。三端互通,5分钟上手,让普通人也能拥有专属数字员工。
1013 6
|
2月前
|
人工智能 机器人 定位技术
2026WAIC展品地图:大模型、国产算力、人形机器人……8 大类全在这
第九届世界人工智能大会(WAIC 2026)7月17—20日在上海举办,首创“三地四馆”联动模式,主题为“智能伙伴,共创未来”。展览面积超10万㎡,1100+企业参展,300+全球首发产品,聚焦大模型、智算、具身智能等八大方向,并首设OPC与Future Tech初创专区。
2989 1
|
3月前
|
缓存 Prometheus 监控
💰 1688开放平台API收费标准与资源包购买攻略(2026最新版)
1688开放平台API采用「免费额度+资源包+按量付费」三层计费模型:基础接口(商品/订单/物流)免费但限QPS;高频或实时库存、分销等需购年费资源包;超量部分按次计费(约0.001元/次)。合理配置可零成本支撑中小B2B系统。
|
机器学习/深度学习 人工智能 分布式计算
AI 大模型时代的网络架构演进
​2025 年 7 月 26 日,第二届中国计算机学会(CCF)分布式计算大会暨中国算力网大会(CCF Computility 2025)在甘肃兰州隆重召开。大会以“算力网:新质生产力背景下的分布式系统”为主题,吸引了来自学术界与产业界的 1200 余位专家学者、行业代表齐聚一堂,共探分布式计算与算力网络的前沿技术与未来趋势。