GTC 2023 | 阿里云弹性计算团队专家演讲推荐

简介: 了解云上弹性磅礴算力背后的关键技术

GTC 2023 大会现已进入倒计时!这场囊括 650 多场演讲、专家座谈会以及特别活动组成的 AI 盛宴,将于3 20 – 23 日在线上拉开帷幕,预计将有超过 25 万人报名参加。包括Open AI 的联合创始人兼首席科学家Ilya StutskeverDeepMind 的创始人兼CEO Demis Hassabis 都将出席。


本次 GTC 大会,来自阿里云弹性计算团队的技术和产品专家,分享话题涵盖:基于阿里云弹性RDMAeRDMA) 技术训练实例提升多机训练性能、视觉计算领域的思考和实践、使用弹性GPU 计算服务和神龙 AI 加速引擎优化 AI 训练性能的软硬协同技术;上述领域的技术和解决方案,也融合了 NVIDIA GPURTX 实时光线追踪、CloudXR 无线 AR/VR 串流技术。

 

点击阅读原文,免费注册,提前将阿里云弹性计算团队专家演讲加入您的GTC日程:

 

随着数字化浪潮的扩大和企业数字化转型需求的增加,中国云计算市场规模持续扩张。根据工信部数据显示,到2022年,中国云计算产业规模超过3000亿元,增速保持高位。


同时,云计算的应用也在不断向更广泛的领域延伸。在这一年,上云的主体用户已经从仅限于互联网企业向各个行业的企业平滑过渡。云计算逐渐从基础资源层向云平台、云应用层面延伸,成为数字经济中不可或缺的“底座”。


然而,企业对云计算的需求也在不断提高。传统的中心云拥有大型的基础设施支持,以资源池化和多租户的方式提供服务;而现在很多企业用户则希望数据可以本地专属,并且需要云计算与用户之间协同工作。


阿里云是全球领先的云计算服务提供商。经过十年的发展,阿里云弹性计算已经随着阿里云业务全球化的步伐,服务覆盖全球200个国家和地区。在中国,超过80%的中国科技创新企业在使用阿里云弹性计算产品。


2017年,阿里云弹性计算推出异构计算产品家族,目前已经形成了丰富的软硬协同产品体系,包括搭载 NVIDIA T4A10V100 GPU 的弹性计算实例,以及相关软件工具,如神龙 AI 加速引擎 AIACC、集群极速构建工具 FastGPUcGPU 容器技术等,同时也发展出来解耦的加速实例 EAIS,让异构计算更具柔性。基于上述产品,异构计算帮助深度学习、图形处理、云游戏、远程渲染、云VR/AR、云转码、云设计等业务降本增效。

 

阿里云弹性计算团队专家演讲推荐


基于阿里云 eRDMA 的训练实例大幅提升多机训练性能

 

会议代码:[S52281]


演讲时间:3月2310:00AM


演讲嘉宾:

李伟男.png

李伟男,阿里云弹性计算高级技术专家

 

宋迪.png

宋迪,阿里云弹性计算产品专家


演讲概要:

 

随着互联网数据量指数级膨胀,数据中心分布式计算的规模以及大规模集群间的数据传输开销也越来越大。弹性RDMAeRDMA) 技术相比传统 TCP 网络,能够大幅降低网络通信延迟,大幅提升分布式计算的性能和性价比。eRDMA 依托阿里云神龙架构,结合NVIDIA GPU 的算力支撑以及兼容 IB verbs 的协议软件接口,最终客户可以无缝迁移线下RDMA 业务上云或者云上实例无缝升级到 eRDMA。本次演讲将分享如何基于阿里云eRDMA 的训练实例大幅提升多机训练性能。

 

 

阿里云视觉计算解决方案思考与实践

 

会议代码:[S52269]


演讲时间:322日即可在线观看(点播形式)

 

演讲嘉宾:

 

张新涛.png

张新涛,阿里云弹性计算产品专家

 

演讲概要:

 

数字人、元宇宙等众多概念在近年来异常火热。虽然 “完全复刻一个虚拟世界” 这样的未来,依然显得十分遥远,但在 2022 年依然有不少落地的探索,比如虚拟偶像与代言人、2D 体验 3D 化、沉浸式演唱会与沉浸式会议等新形式,都在展会、文娱、新零售等行业率先试水。针对这类场景,阿里云推出了视觉计算解决方案,并在上述行业落地了不少实践。本次演讲将为大家分享阿里云在视觉计算领域的思考与实践。

 

基于阿里云弹性 GPU 服务的神龙AI 加速引擎无缝提升 AI 训练性能

 

会议代码:[S52280]


演讲时间:322日即可在线观看(点播形式)

 

演讲嘉宾:

 

林立翔.png

林立翔,阿里云弹性计算高级技术专家


演讲概要:


AI 训练场景是对通信能力和计算能力均有超高需求的业务。围绕 AI 训练在 IAAS 上的竞争力构建,阿里云创造性地实现了以弹性 RDMAeRDMA) 等为代表的软硬协同 AI 加速引擎来提升云上 AI 训练性能。本演讲将聚焦云上 AI 训练的真实业务痛点,并解析阿里云如何通过软硬协同的优化技术来提升 AI 训练性能。

 

如何预约和注册

 

想要预约以上精彩内容?扫描海报二维码 或 点击 “阅读原文”,按照会议代码或标题,找到对应演讲。通过点击  Add to Schedule或  “星星” ,将该演讲内容添加至您的日程,大会开始后登录即可在线观看。

 

海报.png

 

 

按照 会议代码 或者 演讲标题,找到感兴趣的内容

如下图 [S52281]演讲,点击 Add to Schedule,即可添加至您的日程


配图 1.png

 

如无  Add to Schedule按钮,例如下图 [S52280],说明该演讲为自主点播形式

322日开始即可在线观看

点击右上方的 星星,将该演讲添加至您的日程

配图 2.png


如点击  Add to Schedule星星 时,出现如下界面


配图 3.png

 

如果您已注册,请点击 Login登录,激活账户,继续操作;

如果您尚未注册,请点击 Create Account,详情参看GTC23 注册教程

 

请在326日前完成在线注册,免费观看以及回看GTC 2023 春季大会超过650场精彩内容!


相关实践学习
在云上部署ChatGLM2-6B大模型(GPU版)
ChatGLM2-6B是由智谱AI及清华KEG实验室于2023年6月发布的中英双语对话开源大模型。通过本实验,可以学习如何配置AIGC开发环境,如何部署ChatGLM2-6B大模型。
相关文章
|
安全 Linux 数据安全/隐私保护
Intel TME和MKTME技术解析
# 市场需求 人们对透明全内存加密这个功能的需求主要来自对机密和敏感数据的保护。普通RAM里面储存的数据,在掉电之后,一般都以为是彻底消失了。但其实在一些复杂的离线攻击下,这些数据仍然是能被恢复出来并导致泄密;而持久性存储器(即外存,包括磁盘、SSD、eMMC等)的数据更加容易泄露。这些设备可能有硬件锁机制的保护,但是用户其实希望的是更细粒度的保护,比如per进程/容器/VM级的。 Int
6387 0
Intel TME和MKTME技术解析
|
Shell Linux 数据安全/隐私保护
【Shell 命令集合 系统管理 】Linux 修改用户默认shell的命令 chsh命令 使用指南
【Shell 命令集合 系统管理 】Linux 修改用户默认shell的命令 chsh命令 使用指南
599 0
|
人工智能 弹性计算 监控
分布式大模型训练的性能建模与调优
阿里云智能集团弹性计算高级技术专家林立翔分享了分布式大模型训练的性能建模与调优。内容涵盖四大方面:1) 大模型对AI基础设施的性能挑战,强调规模增大带来的显存和算力需求;2) 大模型训练的性能分析和建模,介绍TOP-DOWN和bottom-up方法论及工具;3) 基于建模分析的性能优化,通过案例展示显存预估和流水线失衡优化;4) 宣传阿里云AI基础设施,提供高效算力集群、网络及软件支持,助力大模型训练与推理。
|
11月前
|
Kubernetes Devops API
从零到面试高手:每个 DevOps 专业人士都必须知道的 20 个 Kubernetes 架构问答
Kubernetes 是当前 DevOps、云原生和 SRE 领域的关键技能。本文总结了 20 个高频面试问题,涵盖架构组件、工作原理及核心概念,助你轻松掌握 Kubernetes 基础,提升面试与实战能力。
499 2
|
机器学习/深度学习 人工智能 前端开发
AI+Code驱动的M站首页重构实践:从技术债务到智能化开发
本文分享了阿里巴巴找品M站首页重构项目中AI+Code提效的实践经验。面对M站技术栈陈旧、开发效率低下的挑战,我们通过楼层动态化架构重构和AI智能脚手架,实现了70%首页场景的标准化覆盖 + 30%的非标场景的研发提速,开发效率分别提升90%+与40%+。文章详细介绍了楼层模板沉淀、AI辅助代码生成、智能组件复用评估等核心实践,为团队AI工程能力升级提供了可复制的方法论。
949 15
AI+Code驱动的M站首页重构实践:从技术债务到智能化开发
|
JSON 中间件 Go
go语言后端开发学习(四) —— 在go项目中使用Zap日志库
本文详细介绍了如何在Go项目中集成并配置Zap日志库。首先通过`go get -u go.uber.org/zap`命令安装Zap,接着展示了`Logger`与`Sugared Logger`两种日志记录器的基本用法。随后深入探讨了Zap的高级配置,包括如何将日志输出至文件、调整时间格式、记录调用者信息以及日志分割等。最后,文章演示了如何在gin框架中集成Zap,通过自定义中间件实现了日志记录和异常恢复功能。通过这些步骤,读者可以掌握Zap在实际项目中的应用与定制方法
1052 1
go语言后端开发学习(四) —— 在go项目中使用Zap日志库
|
存储 弹性计算 虚拟化
基于阿里云eRDMA的GPU实例大幅提升多机训练性能
2023年3月23日14:00(中国时间),NVIDIA GTC开发者大会,阿里云开发者社区观看入口正式开放,阿里云高级技术专家李伟男;阿里云弹性计算产品专家宋迪共同带来了题为《基于阿里云eRDMA的GPU实例大幅提升多机训练性能》的分享
基于阿里云eRDMA的GPU实例大幅提升多机训练性能
|
存储 弹性计算 Serverless
什么是阿里云FPGA云服务器?FPGA云服务器产品优势及应用场景介绍
FPGA云服务器是阿里云提供的实例规格,融合现场可编程门阵列的低延迟硬件加速与弹性资源。FaaS平台简化了FPGA开发,提供统一硬件、开发环境和丰富的IP生态。特性包括硬件虚拟化、联合仿真和动态互联配置。产品计费与ECS一致,支持多种计费模式。优势在于分钟级交付、高性能加速、经济性价比和设计复用。应用广泛,如视频转码、人工智能、基因测序等。FPGA云服务器通过FPGA镜像、OSS服务等工具进行管理。
什么是阿里云FPGA云服务器?FPGA云服务器产品优势及应用场景介绍
|
缓存 NoSQL 关系型数据库
PostgreSQL 与基友们的故事之 - Redis (无限缓存,实时标签...)
在PostgreSQL中直接读写REDIS。好处多多,可以降低应用层设计的复杂度,减少交互次数,降低RT。同时还能使用redis作为PostgreSQL的二级缓存, 提升数据库的性能。PostgreSQL的好基友还真多,redis也是其中一个。 下面简单的介绍一下redis_fdw插件的安装和
26478 147
|
存储 消息中间件 缓存
【Cassandra从入门到放弃系列 一】概述及基本架构
【Cassandra从入门到放弃系列 一】概述及基本架构
4851 1

热门文章

最新文章