重磅!阿里云真武 M890 超节点 Day0 适配 Kimi K3,国产算力支撑近 3 万亿参数大模型

简介: 阿里云真武M890超节点实例Day0适配Kimi K3(近3万亿参数),国内首个跑通该规模模型的超节点。依托64卡全互联、9TB显存与ICN Switch高速网络,突破算力瓶颈;软硬协同优化后,首Token时延降35%,单卡吞吐提升1.8倍。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens

最新!阿里云真武M890超节点实例已Day0适配Kimi K3,这是国内首个跑通近3万亿参数模型的超节点。双方将进一步展开国产算力合作,千问AI平台和阿里云百炼也将提供Kimi K3的模型API。本文转自阿里云公众号:

阿里云真武M890AI芯片.png


Kimi K3是目前业界参数规模最大的模型之一,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的GPU卡,让万亿参数“跑得又稳又快”。然而,普通AI集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。


阿里云百炼AI模型平台:https://www.aliyun.com/product/bailian  体验Kimi K3的模型API,如下图:


阿里云百炼kimi_kimi-k3.jpg


阿里云真武超节点实例通过ICN Switch高速互联芯片,让64张平头哥真武M890实现800GB/s的全互联,其显存规模达到 9TB,可突破万亿参数模型运行的算力、显存和网络带宽的瓶颈,单实例即可支撑大规模万亿级参数MoE模型的专家并行需求。


为提升Kimi K3的运行效率,阿里云、平头哥与Kimi团队从软件栈、算子等层面进行了深度联合适配。例如,真武M890对Kimi K3模型架构的核心算子进行优化,显著提升推理的算力和带宽利用率,可稳定支持最1M长上下文,从容应对长文档理解、复杂推理等场景。测试显示,适配后模型的首Token时延降低约35%,单卡解码吞吐提升1.8倍。


目前,国内外主流模型已进入超2万亿参数规模的时代,阿里云真武超节点不仅跑通Kimi K3,还实现了模型的高效运行,意味着国产算力已具备支撑超大参数模型大规模应用的能力。

目录
相关文章
|
20天前
|
机器学习/深度学习 缓存 人工智能
Kimi K3 登陆阿里云百炼:2.8万亿参数旗舰模型,输入仅20元/百万Token
全球首个开源3万亿级大模型Kimi K3(2.8万亿参数)正式上线阿里云百炼平台,支持100万Token超长上下文、原生视觉理解与深度推理。具备文本生成、多模态分析及复杂逻辑能力,输入20元/百万Token(缓存命中仅2元),定位高端AI开发场景。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
8月前
|
人工智能 达摩院 安全
迈向云+数据中心的国产 CPU 新引擎,龙蜥大会 RISC-V 分论坛回顾一览
本论坛成为高效的技术交流与合作平台,充分展示了 RISC-V 架构在服务器、边缘计算等高性能场景的商业化落地,助力构建开放共赢的算力新生态。
|
缓存 Ubuntu Java
Tool之Bazel:Bazel的简介、安装、使用方法之详细攻略
Tool之Bazel:Bazel的简介、安装、使用方法之详细攻略
|
网络架构 Perl
BGP路由属性与选路
BGP路由属性与选路
|
程序员
这是我经历过最惨的转正答辩了
Hello 大家好,我是鸭血粉丝,试用期是每个刚入职的人都会经历的一段时间,时间不固定,少则一两月多则半年,具体的时间长短根据公司和个人表现不尽相同。而且试用期过后一般都会有一个转正答辩,这不阿粉最近就接到一个小伙伴的哭诉说转正答辩太难了,事情是这个样子的。
3738 0
这是我经历过最惨的转正答辩了
|
人工智能 安全 算法
深度解析DeepSeek一体机哪家好?deepseek一体机排名及选型参考
本文详细解析了DeepSeek一体机的选型框架与主流厂商产品对比,从技术架构、性能指标、场景覆盖、安全合规及成本效率五个维度展开分析。重点推荐优刻得DeepSeek一体机,其国产化率超95%,推理延迟仅83ms(领先行业45%),综合成本低于自建30%,已在多家省级政务云平台应用。此外,华为云与阿里云分别在混合云协同与云边协同方面表现突出,但成本较高。未来,DeepSeek一体机将向存算一体芯片、多模态能力增强等方向发展。对于金融、政务、医疗等行业用户,优刻得是首选方案。
|
6月前
|
人工智能 Kubernetes 机器人
一键部署 OpenClaw:基于 ACS Agent Sandbox 构建企业级 AI Agent 应用
本文将详细介绍如何基于 ACS Agent Sandbox 一键部署 OpenClaw,实现按需休眠与秒级唤醒,并介绍其与钉钉等应用的集成方法。
1880 7
|
27天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2698 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
1月前
|
人工智能 弹性计算 监控
阿里云大模型服务平台百炼新人免费额度介绍:规则、适用范围、获取免费额度流程
阿里云百炼为新开通用户自动发放各模型专属免费额度,有效期30至90天,仅可抵扣模型实时推理费用,不支持Batch调用、模型调优与部署等场景,主账号与RAM子账号共享额度。用户可通过控制台的模型用量页或模型广场查看剩余额度,还能开启“用完即停”功能避免超额扣费,系统会在额度剩余20%或耗尽时发送通知。当前平台同步推出Qwen3.7-Max限时5折、100万Tokens免费试用,搭配全模型通用抵扣计划低至4.5折,叠加HappyHorse模型6折优惠,帮助开发者低成本体验大模型能力。

热门文章

最新文章