超哈佛、灭剑桥!杨元庆捐的这套1亿超算有多厉害?

简介: 超哈佛、灭剑桥!杨元庆捐的这套1亿超算有多厉害?

021年12月14日,今天,上海交通大学一场活动,改写着中国甚至是全球顶尖大学科研设施的技术格局,“思源一号”高性能计算中心正式揭牌,这个名字虽然文字彬彬,但内藏的科技与性能确如野兽一般。“思源一号”每秒6000000000000000次浮点运算能力,有多少个0,慢慢数一下。


如果你不理解上面数字的含义,我可以大概普及一下。“思源一号”在中国高校算力中排名第一,在全球高校算力中排名前列,至此,“思源一号”打破了全球顶级高校前列超算中心中没有中国身影的局面。排在其身后的,有哈佛、剑桥等一众名校。如果,我再告诉你,这两所大学分别出过超过160位和120位诺贝尔奖得主,也就是说,这些宇宙最顶尖的科学家都未必用过这么先进的设备!他们最重要的科研设施之一,开始落后于我们了!


这么厉害的“思源一号”从哪来的?


我们要把时间拉回到2021年4月10日,在上海交通大学125周年校庆时,杨元庆以个人名义出资向其母校捐赠一套价值1亿的高性能计算中心,并将其命名为“思源一号”,“思源一号”于2021年9月底落成,11月投入运营使用。


image.png


杨元庆与上海交大师生交流,身后为“思源一号”“思源一号”安置在了交大的李政道研究所。李政道是谁?诺贝尔物理学奖获得者,因在宇称不守恒、李模型、相对论性重离子碰撞(RHIC)物理、和非拓扑孤立子场论等领域的贡献闻名。


image.png

李政道研究所


2016年上海交大的官网上写到,党委书记姜斯宪表示,为贯彻落实习近平总书记对李政道先生倡议在中国建立类似玻尔研究所的研究基地的重要批示精神,经过一年多的深入探讨,教育部、科技部和上海市政府批准同意依托上海交通大学成立“李政道研究所”,这既是国家与上海市努力打造世界级研究机构的有力举措,也是把上海建设成为有全球影响力的科技创新中心的重要支撑。


上面有一个很重要的信息——对标玻尔研究所,这里是著名的量子力学发源地,科学界视其为殿堂级的科研场所。也就是说,我们中国也要建设出世界上最顶级的科研圣地!目前,中科院院士张杰担任李政道研究所新任所长。


2003年至2006年张杰担任中美高能物理会谈中方代表团团长,在李政道的言传身教下工作,并被李政道称为“忘年至交”。成立五年后,李政道研究所迎来了全球高校第一梯队的高性能计算中心,中国的基础科研按下了快进键。


“思源一号”它厉害在哪?


这个家伙的算力在前面说过了,现在揭晓答案——6千万亿次/秒(双精度),其中CPU提供了5.1千万亿次,GPU提供了约0.9万亿次。Linpack效率高达70%。全球HPC TOP500排名 132位,中国HPC TOP100排名第12位。


image.png


它采用了以下先进技术:

1)联想第五代海神温水冷服务器;(不要小看这个温水水冷技术,这是超算安全、稳定、节能运行最关键的技术,下面会详细介绍,全世界的竞争对手都在羡慕嫉妒恨)

2)Intel最新Whitley平台,Icelake CPU;

3)英伟达最新安培架构 A10040GNVLINK GPU;

4)水冷高速低延迟网络100G IB网络。


除计算力外,系统还具备以下亮点:

1)超高计算密度与功耗密度:实现6千万亿次的计算能力,仅需要14个机柜,一般通用数据中心需要70个机柜才能达到类似算力,计算密度是通用数据中心的5倍,需要的机房面积不足通用机房的1/10。这个家伙的占地仅有300平米!

2)温水冷带来的绿色节能:中国数据中心的平均PUE 1.9,意味着每用1度电计算,就需要额外0.9度电给计算设备进行散热。而“思源一号”由于采用了联想第五代温水冷技术,系统PUE(能源利用效率)可以到1.1,与通用风冷计算设备比较节省电力和CO2排放 42%。由于90%的计算器件产生的热量将通过冷板中流动的温水带走,因此减少了系统风扇功耗。同时由于流动的是50-60°温水,因此可以充分利用环境来散热,从而节省了因使用空调压缩机而带来的额外散热能耗。

3)余热回收:系统通过温水散热,进水温度50°,出水温度60°。从而使得余热回收成为可能。目前这套系统产生的余热将为以下基础设施进行供热:1)冬天的供暖;2)食堂厨房的热水加热;

3)地下室的除湿;

4)实验室的空调温控。通过利用余热回收再利用替代原来需要消耗的电力、燃气能源,能够实现每年950吨,约10%左右的额外碳排补偿,同时每年将为客户节省150万以上的费用。

这是一套算力强!占地小!绿色节能!安全稳定!的超级计算中心。


 既然这么厉害,“思源一号”都能用来干什么?


作为上海交通大学的科研中坚力量,他们在科研工作中会常常运用到“思源一号”。那么它主要会用来干什么呢,我们先看看李政道研究所的研究方向。中科院高能所对其的介绍是,李政道研究所在粒子与核物理、天文与天体物理、量子基础科学三个方向开展研究,聚焦于“进行暗物质与暗能量的研究,寻找宇宙中极大和极小间的关联,探索自然界最基本和最深刻的相互作用规律”。


已在暗物质与中微子物理、实验室天体物理、量子物质探索、拓扑超导量子物理、暗能量研究、黑洞、系外行星等领域开展了前沿研究。


经与国际学术咨询委员会讨论,确定研究所的主要研究方向包括宇宙的起源和演化、时空和基本物理规律起源、暗物质与暗能量、新奇量子态、量子计算和量子信息等,此外还将探索更加有效的办法将计算机运用于物理学前沿科研活动中以及如何利用涌现现象为研究宇宙开辟新的研究窗口。


总结下来就是,粒子、核、天体、宇宙起源、量子,几乎涵盖了全世界最顶尖的方向,如果没有强大的计算设备,同一个细节的课题,恐怕我们会落后国外几年才能得到答案。


除了研究所,我们再看看交大学生和老师研究的例子: 


▪ 钟博子韬,生命与科学学院本科,电院计算机系本科 。研究方向聚焦于生物学和计算机科学的交叉领域,包括分子动力学模拟,深度学习在蛋白质结构计算中的应用等。代表性研究课题为高通量AlphaFold蛋白质结构预测。


▪ 左思成,电院计算机系研二学生。研究方向为高性能计算以及计算机体系结构相关方面的研究。参与过的项目包括ARM架构芯片的评测,如鲲鹏920,AmpereAltra;格点量子色动力学在超算平台上的并行优化。同时,活跃于国内许多超算类赛事的赛场上。


▪ 薛峤,物理与天文学院大三学生。目前正在跟随组内博士生开发一套利用照相系统分析海水光学性质的全新方法学。  


▪ 上海交通大学物理与天文学院陈民教授。主要研究方向——激光尾波加速和辐射、强场QED等离子体物理。  


▪ 上海交通大学物理与天文学院张骏教授。主要研究方向——宇宙大尺度结构的形成以及其背后的物理规律。


▪ 上海交通大学物理与天文学院王伟教授。主要研究方向——重味物理理论,工作集中在重味强子弱衰变和量子色动力学方向。


▪ 李政道研究所博士后研究员邹海源。主要研究方向——强关联多体系统,量子计算和动力学,冷原子系统等。 例子太多,无法一一例举。作为“思源一号”的捐赠人杨元庆,在揭牌仪式上感慨的表示“它终于可以正式服务于母校基础科研和重大项目之中,赤兔马遇到了关将军,物尽其用。思源精神不仅是我对母校的情怀,也是联想对社会和国家的使命和责任。我们将一起努力,为推动国家科技和产业发展贡献更多力量。”


最后,想起交大闵行校区的一句标语——祖国终将选择那些选择了祖国的人。向我们的科学家致敬,祝愿他们能够实现心中的科学梦想。

相关文章
|
消息中间件 存储 负载均衡
RabbitMQ使用docker搭建集群并使用Haproxy实现负载均衡(多机镜像模式)
RabbitMQ使用docker搭建集群并使用Haproxy实现负载均衡(多机镜像模式)
1180 0
RabbitMQ使用docker搭建集群并使用Haproxy实现负载均衡(多机镜像模式)
|
人工智能 负载均衡 安全
云上AI推理平台全掌握 (3):服务接入与全球调度
阿里云人工智能平台 PAI 平台推出的全球化的服务接入矩阵,为 LLM 服务量身打造了专业且灵活的服务接入方案,正重新定义 AI 服务的高可用接入标准——从单地域 VPC 安全隔离到跨洲际毫秒级调度,让客户的推理服务在任何网络环境下都能实现「接入即最优」。
|
运维 分布式计算 监控
Dataphin深度评测:企业级数据中台的智能实践利器
Dataphin是一款以全链路治理、智能提效和高兼容性为核心的企业级数据中台工具,特别适用于中大型企业的复杂数据场景。其流批一体能力、资源监控工具及行业化模板库可显著提升数据治理水平并降低运维成本。通过周期补数据功能,历史数据修复效率提升约60%;智能建模功能使建模时间缩短50%。尽管在数据源支持(如SAP HANA、DB2)和用户体验上仍有改进空间,但其强大的功能使其成为构建企业级数据中台的优选工具,尤其适合零售、金融等行业需要高效数据治理与实时分析的企业。
|
API 语音技术 开发者
Python 项目打包,并上传到 PyPI,分享项目
本文介绍了如何使用 Poetry 打包并发布一个 Python 项目至 PyPI。内容包括:项目创建、配置 `pyproject.toml` 文件、构建软件包、上传至 PyPI、安装与使用。通过实例 iGTTS 展示了从开发到发布的完整流程,帮助开发者快速分享自己的 Python 工具。
|
机器学习/深度学习 人工智能 程序员
MiniMind:3小时训练26MB微型语言模型,开源项目助力AI初学者快速入门
在大型语言模型(LLaMA、GPT等)日益流行的今天,一个名为MiniMind的开源项目正在AI学习圈内引起广泛关注。项目让初学者能够在3小时内从零开始训练出一个仅26.88MB大小的微型语言模型。
991 1
|
人工智能 分布式计算 数据处理
MaxCompute Data + AI:构建 Data + AI 的一体化数智融合
本次分享将分为四个部分讲解:第一部分探讨AI时代数据开发范式的演变,特别是MaxCompute自研大数据平台在客户工作负载和任务类型变化下的影响。第二部分介绍MaxCompute在资源大数据平台上构建的Data + AI核心能力,提供一站式开发体验和流程。第三部分展示MaxCompute Data + AI的一站式开发体验,涵盖多模态数据管理、交互式开发环境及模型训练与部署。第四部分分享成功落地的客户案例及其收益,包括互联网公司和大模型训练客户的实践,展示了MaxFrame带来的显著性能提升和开发效率改进。
|
供应链 数据挖掘 API
探秘淘宝商品SKU信息API接口
在电子商务中,SKU(库存量单位)用于区分商品的不同规格、颜色、尺寸等属性,是精细化管理的基础。本文深入探讨淘宝商品SKU信息API接口,介绍其功能特点、使用方法及应用场景,并提供Python代码示例。该API支持实时更新、多维度筛选,帮助开发者获取全面的SKU信息,优化库存管理、订单处理和销售数据分析,提升运营效率与市场竞争力。
1331 1
|
存储 分布式计算 算法
企业级推荐开发平台 PAI-Rec
本文介绍了企业推荐系统的关键技术和解决方案。主要内容分为四部分:1) 推荐系统面临的挑战,如数据治理和算法优化;2) 提高开发效率的解决方案,通过配置化和自动化减少重复工作;3) 高性能推荐算法和推理服务,包括GPU优化和特征组合;4) 高效特征管理平台PAI FeatureStore,支持离线和实时特征处理。文中还提到了EasyRecTorch框架,用于加速训练和推理,并分享了如何通过这些工具提升推荐系统的性能和降低成本。
序列化流 ObjectInputStream 和 ObjectOutputStream 的基本使用【 File类+IO流知识回顾④】
这篇文章介绍了Java中ObjectInputStream和ObjectOutputStream类的基本使用,这两个类用于实现对象的序列化和反序列化。文章解释了序列化的概念、如何通过实现Serializable接口来实现序列化,以及如何使用transient关键字标记不需要序列化的属性。接着,通过示例代码演示了如何使用ObjectOutputStream进行对象的序列化和ObjectInputStream进行反序列化。
序列化流 ObjectInputStream 和 ObjectOutputStream 的基本使用【 File类+IO流知识回顾④】