阿里云架构师马颂:云上高性能计算助力基因测序

本文涉及的产品
轻量应用服务器 2vCPU 1GiB,适用于搭建电商独立站
轻量应用服务器 2vCPU 4GiB,适用于搭建容器环境
轻量应用服务器 2vCPU 4GiB,适用于搭建Web应用/小程序
简介: 基于E-HPC的大内存实例解决方案:算得快、成本低、简运维、助生态

摘要:本文整理自阿里云行业解决方案架构师马颂(栖逸),在阿里云计算情报局的分享。本篇内容主要分为三个部分:

1.  寻因生物简介

2.  单细胞测序及其痛点

3.  寻因生物基于E-HPC的大内存实例解决方案


01 寻因生物简介


1.png


寻因生物创始团队及公司于2018年正式启动组建运营,是一家专注于单细胞技术的生物科技企业。致力于通过自主研发的高通量单细胞产品实验及生信分析全链条服务,将单细胞技术普适化,助力临床诊断和药物研发,推动精准医疗进入2.0时代。


这家成立于2018年,驻扎在北大医疗产业园的初创企业,在2022年1月获得D轮融资,并在上海、广州和成都设立地方实验室。公司面向临床及科研工作者的实际需求,搭建了从样本保存、解离到生信分析的全链条单细胞测序产品及服务解决方案。客户将样本送到寻因生物上海、广州或成都的实验室。


样品采集到之后,在实验室中通过实验进行序列加工和信号放大,将分子循环扩增,给每一个分子和细胞加上标签。辅助识别检测的分子来自哪个细胞、哪个基因。而后通过物流的方式送到北京进行测序。测序的结果上传到寻因的阿里云OSS或通过专线下载到本地,再做单细胞分析。


02 单细胞测序及痛点


2.png


单细胞测序作为2009年首次问世的技术,无疑是现在生命科学基础研究的最大热门。2013年单细胞RNA测序被nature method评为年度技术。2015年单细胞测序技术再度登上science转化医学封面。


单细胞测序,顾名思义是在单个细胞水平,对细胞的基因表达等信息进行检测,对于多细胞生物来说,细胞与细胞之间是有差异的。


相对于传统的测序研究,局限于器官与组织。群体细胞的表达水平,最终得到的信号值,丢失了抑制性信息。单细胞测序可以更高分辨率,解释细胞间的差异,及其在环境中的功能情况,防止细胞间的滥竽充数。


该技术已经应用在基础科研、临床诊断、新药研发等各个领域。作为一项高效的医疗辅助手段,基因测序在预防出生缺陷、检测遗传性疾病、肿瘤用药等领域提供了有效帮助。

3.png


单细胞测序技术的蓬勃发展,也助力了寻因生物业务起步。公司自2021年3月份商业化销售以来,已与100家客户建立科研合作关系。通过屏幕左侧典型单细胞数据分析的步骤流程图,可以看到,在单细胞测序的最后一步,数据分析环节需要针对单细胞测序数据,进行数据预处理。


比如质控、归一化、数据矫正、特征选择、聚类分析、轨迹分析、差异表达分析、基因动力学、亚稳态分析、成分分析等。仅一个单细胞测序的文件大小可达100GB以上。随着一个单细胞项目包含的样本量越来越多,细胞数据级别往往达到数百GB甚至TB。


其次,单细胞数据的分析复杂需要反复做数据读取和参数调整。导致处理海量细胞样本的分析任务,通常要数小时甚至数天才能完成。


当样品量上来,各个样品之间又要做各种关联,或者是更复杂的计算,对于算力的消耗量就会非常大,对算力的要求更高


超大数据量和分析复杂性会导致任务并发数低,数据加载速率慢。除此之外,生物信息行业缺少一个覆盖全程的开源软件。通常一个生物计算项目需要多个软件配合,随着单细胞检测的成本逐渐降低,应用面越来越广,生信数据将是指数级的增长。


生信分析的惯用操作是将样本参数调低,或者仅运行一个比较大型的单细胞分析任务。但在测序任务多的情况下,多个单细胞分析项目只能排队执行。


03 基于E-HPC的大内存实例解决方案


4.png


为了解决上述问题,阿里云为寻因生物搭建了基于E-HPC的大内存实例解决方案。这套方案主要由三部分组成。第一部分是大内存云实例,搭配合作伙伴推出的内存虚拟化软件


2017年,英特尔奥腾SSD推出;2020年,英特尔发布奥腾持久内存100系列,成功完成大规模的商业化;2021年,英特尔发布第三代英特尔至强可扩展处理器,及英特尔奥腾持久内存200系列。同年,阿里云基于以上产品开发了性能更加强大的不同实例规格。


其中,I4P能够提供性能极高的本地盘延时可以缩短至170纳秒,非常适用于重IO型应用帮助此类应用突破性能瓶颈。


寻因生物的单细胞测序分析任务,部署在了基于第三代英特尔至强可扩展处理器,和第二代英特尔奥腾持久内存,I4P持久内存型实例上。配合第一款虚拟化内存硬件的软件Memory Machine,对容量、性能、可用性和移动性进行精细化的资源调配。


在透明内存服务的基础上,还提供了另一个行业第一的技术Zero Io内存快照。该技术可以在几秒钟内封装数TB的应用程序状态,并以内存速度实现数据管理。


第二部分,阿里云的计算巢模式。云厂商开放给企业应用服务商和其客户服务管理的PaaS平台。阿里云让Memory Machine大内存虚拟化软件与云平台的标准化集成加速软件交付部署,并标准化运维管理,大幅提升了业务效率。


第三部分,阿里云弹性高性能计算平台E-HPC,可将寻因生物底层使用的不同规格ECS及存储实例自动纳管和调度。一键安装部署生命科学相关的软件及其运行环境。


自动在业务高峰扩容低谷释放,避免资源浪费,大大节省运维成本。此外,E-HPC可将HPC和软件一键安装部署,免去每个实例,分别安装软件的繁复工作。

5.png


阿里云的大内存实例解决方案,在以下四方面助力寻因生物业务。


第一,算得快。E-HPC解决方案简化编写流程、监控任务投递,以及任务运算的过程。数据加载和导出性能从1000秒缩至2.5秒;单任务的样本规模是原来的2倍。在运行时间和单任务的运行时间几乎差不多的情况下,测序任务的井发运行数由原来的1个提升到了5个,任务处理效率提升了5倍之多。


第二,成本低。E-HPC保证整体算力的同时,动态创建/删除计算节点,避免了资源浪费;提高作业质量及速度,输出丰富云原生能力支撑ECS支持抢占式实例,OSS支持冷归档:付费模式多元,结合业务的需求及数据保存的性能和周期,支持成本出发的精细化调整。


第三,简运维。E-HPC将寻因生物底层使用的不同规格ECS实例自动纳管与调度,可将生命科学相关的HPC软件及其运行环境一键安装部署,将带有MemVerge软件的ECS实例自动纳管与调度,大大节省运维成本通过阿里云的计算巢蟆式将MemoryMachine大内存虚拟化软件与云平台的标准化集成,加速软件交付部署井标准化运维管理,大幅提升了业务效率。


第四,助生态。阿里云多年深耕生物信息行业,已形成多种服务方案和客户资源,能够为上下游生物科技企业的互联互通提供更多支持寻因,基于阿里云开发出直接向用户提供服务的单细胞分析平台,赋予科研用户和药物研发用户分析单细胞数据的能力。


点击这里,观看嘉宾的演讲视频回放。

相关文章
|
14天前
|
存储 数据挖掘 BI
2-5 倍性能提升,30% 成本降低,阿里云 SelectDB 存算分离架构助力波司登集团实现降本增效
波司登集团升级大数据架构,采用阿里云数据库 SelectDB 版,实现资源隔离与弹性扩缩容,查询性能提升 2-5 倍,总体成本降低 30% 以上,效率提升 30%,助力销售旺季高效运营。
73 9
|
5月前
|
人工智能 算法 网络安全
基于PAI+专属网关+私网连接:构建全链路Deepseek云上私有化部署与模型调用架构
本文介绍了阿里云通过PAI+专属网关+私网连接方案,帮助企业实现DeepSeek-R1模型的私有化部署。方案解决了算力成本高、资源紧张、部署复杂和数据安全等问题,支持全链路零公网暴露及全球低延迟算力网络,最终实现技术可控、成本优化与安全可靠的AI部署路径,满足企业全球化业务需求。
|
16天前
|
存储 弹性计算 运维
AI 时代下阿里云基础设施的稳定性架构揭秘
十五年磨一剑,稳定性为何是今天的“命门”?
|
2月前
|
SQL 运维 数据挖掘
森马服饰从 Elasticsearch 到阿里云 SelectDB 的架构演进之路
森马引入阿里云 SelectDB 替换原 Elasticsearch + 业务库混合架构,统一分析 16+ 核心业务,打通 BI 组件,大幅简化数据同步链路和分析系统架构。实现复杂查询 QPS 提升 400%,响应时间缩短至秒级,亿级库存流水聚合查询缩短至 8 秒内的显著收益,有效驱动森马全渠道运营效率持续增长与业务创新。
84 0
森马服饰从 Elasticsearch 到阿里云 SelectDB 的架构演进之路
|
3月前
|
存储 缓存 分布式计算
高内存场景必读!阿里云r7/r9i/r8y/r8i实例架构、性能、价格多维度对比
阿里云针对高性能需求场景,一般会在活动中推出内存型r7、内存型r9i、内存型r8y和内存型r8i这几款内存型实例规格的云服务器。相比于活动内的经济型e和通用算力型u1等实例规格,这些内存型实例在性能上更为强劲,尤其适合对内存和计算能力有较高要求的应用场景。这些实例规格的云服务器在处理器与内存的配比上大多为1:8,但它们在处理器架构、存储性能、网络能力以及安全特性等方面各有千秋,因此适用场景也各不相同。本文将为大家详细介绍内存型r7、r9i、r8y、r8i实例的性能、适用场景的区别以及选择参考。
|
5月前
|
弹性计算 负载均衡 网络协议
阿里云SLB深度解析:从流量分发到架构优化的技术实践
本文深入探讨了阿里云负载均衡服务(SLB)的核心技术与应用场景,从流量分配到架构创新全面解析其价值。SLB不仅是简单的流量分发工具,更是支撑高并发、保障系统稳定性的智能中枢。文章涵盖四层与七层负载均衡原理、弹性伸缩引擎、智能DNS解析等核心技术,并结合电商大促、微服务灰度发布等实战场景提供实施指南。同时,针对性能调优与安全防护,分享连接复用优化、DDoS防御及零信任架构集成的实践经验,助力企业构建面向未来的弹性架构。
427 76
|
3月前
|
消息中间件 存储 大数据
阿里云消息队列 Kafka 架构及典型应用场景
阿里云消息队列 Kafka 是一款基于 Apache Kafka 的分布式消息中间件,支持消息发布与订阅模型,满足微服务解耦、大数据处理及实时流数据分析需求。其通过存算分离架构优化成本与性能,提供基础版、标准版和专业版三种 Serverless 版本,分别适用于不同业务场景,最高 SLA 达 99.99%。阿里云 Kafka 还具备弹性扩容、多可用区部署、冷热数据缓存隔离等特性,并支持与 Flink、MaxCompute 等生态工具无缝集成,广泛应用于用户行为分析、数据入库等场景,显著提升数据处理效率与实时性。
|
5月前
|
存储 机器学习/深度学习 算法
阿里云X86/ARM/GPU/裸金属/超算等五大服务器架构技术特点、场景适配与选型策略
在我们选购阿里云服务器的时候,云服务器架构有X86计算、ARM计算、GPU/FPGA/ASIC、弹性裸金属服务器、高性能计算可选,有的用户并不清楚他们之间有何区别。本文将深入解析这些架构的特点、优势及适用场景,帮助用户更好地根据实际需求做出选择。