云上的精准医疗——公有云、私有云案例分析和比较

简介: 在2016杭州云栖大会第二日,北京中科晶云科技有限公司云平台产品总监卜德超在基因计算专场分享了《抗击:大数据分析助力遗传病肿瘤精准医疗》,他简要介绍了精准医疗,并且通过两个案例分别介绍了中科晶云在公有云和私有云上针对不同场景的解决方案。

在2016杭州云栖大会第二日,北京中科晶云科技有限公司云平台产品总监卜德超在基因计算专场分享了《抗击:大数据分析助力遗传病肿瘤精准医疗》,他简要介绍了精准医疗,并且通过两个案例分别介绍了中科晶云在公有云和私有云上针对不同场景的解决方案

以下内容根据演讲PPT及现场分享整理。


 精准医疗时代

医药学领域从来不缺乏大数据,基于二代测序技术的基因检测大数据时代已经来临。精准医疗的短期目标是加强精准医疗在肿瘤、遗传病诊断治疗上的应用。精准医疗的长期目标是创建一个融合参与者、有责任的数据共享以及隐私保护的新型研究模型,挖掘疾病新的规律、发现新的诊疗模式。

痛点及难点

ae946a0a08024ebed7316b4985a98ba2ef71ba3b

精准医疗进行得如火如荼,其中测序已经不再是问题,目前最关键的问题是数据的解读和分析。针对上述问题中科晶云构建了云平台。

6c05db80aa0dc6b8c71b596a90b860652ad9b89f

如上图所示,细分为两个应用场景。单基因遗传病采用了公有云平台,肿瘤伴随诊断一体机采用的是私有云平台,因为一体机直接连接了测序仪,所以只能采用私有云模式。

单基因遗传病云平台

d1c35f42eb27031beb6b03173614e1b178cb437e

单基因遗传病是指只要一个基因异常就可以导致遗传病。单基因遗传病是如何检测出来的呢?往往是一个患者有各种的表型,导致临床难以诊断出来,但是通过基因测序可以找到其致病位点。这种方式反应了基因和疾病的关联关系,只有这种关系准确才能保证找出来的致病位点准确。针对这种案例,晶云平台采取了两个步骤:变异鉴定,变异解读。从用户的角度,主要通过数据上传、变异鉴定、变异解读、分析报告四个步骤完成解读。

数据上传

7ef683e6f454b08640a099642f63018cf580651f

使用了阿里的OSS,速度稳定可靠,支持断点续传等技术。

变异鉴定

ceb96a9c26f53337c9a68fde726373bc28172783

主要分为三种鉴定方式:单核苷酸变异(SNV)、插入缺失变异(INDEL)、拷贝数变异(CNV)。由于计算得到的结果有complex或者mnp的现象,所以鉴定之后需要有一个校正的过程来获得一个更准确的结果。阿里提供了一个很好的批量计算的能力——BCS服务,晶云利用BCS服务能够很快的将系统构建到云端,万核级的并行,不用再担心业务吞吐的限制。最终云端的分析速度达到了:全基因组测序数据,10亿Reads,100G数据在24小时内完成;全外显子测序数据,1亿Reads,10G数据大约5个小时完成;靶向测序数据,4 M Reads,330M数据大约14分钟完成。

变异解读

afca456e417ee8a93ea4df4ce26e429b2b951698

变异解读最关键的是需要具备基因和疾病相关的知识库,单基因遗传病最重要的是OMIM数据库。为了能让医学更好的介入变异解读,将OMIM数据库超过五千条单基因遗传病及其表型进行汉化,构建了中文的语义分词检索的算法。同时,将遗传规律做了细分,加上了可能常显、可能常隐两种规律。因为很多基因遗传病刚开始并不知道其遗传方式,OMIM只拥有五千多基因的数据库,而人类有两万多的基因,有些我们不知道的基因同样可能致病。

6eb04becc5ef3381bf3fe165b5260766ee8b9bc8

基于上下文的信息,构建了实现Reads可视化的浏览器。黄色部分是变异,白色部分是缺失的情况,从这个图我们可以直观地看到Reads传达的信息。那么,怎么在1000亿的数据中查出想要的信息?晶云采用了阿里的OTS进行了实现。OTS是分布式的表格存储,能很快的从大量数据中检索出想要的信息,精准获得想要区间的Reads信息。

分析报告

报告分为三个梯度:与患者表型相符的结果;与遗传方式明确的疾病相符的结果;与遗传方式不明确的疾病相符的结果。

晶锐肿瘤伴随诊断私有云平台

7fadd97f48c2428d7b1bd1b8febbb74509f84ba6

晶锐TM专用一体机与测序仪会有一个直连,然后经过两个关键的环节(找驱动基因、根据驱动基因获得推荐的治疗方式)。在底层,做了数据存储、计算、解读、传输、隐私等方面的管理。

81ff1ea3e189a354c80c6aaffd11b09eb2f5aff5

一体机模块如上图所示。最底层是云存储和计算,其上方是NGS数据分析模块、基因型和疾病型模块。右边是管理性的,包括API、数据管理、可视化。

e48b3cee8cb5e5ee9ef5fe1e705409b7b648cfef

私有云也是可以伸缩的。最简单的情况,可以把这七项服务都布在一个节点上,相当于一台集成的服务器。每个服务也可以进行扩充,比如左下角的生物信息服务可以不断增加运算节点。右边是文献存储的API,包括API和Web。

一体机有4个特色:易、准、快、可定制。

“易”是指自动抓取,一键操作。易是直连测序仪的目的,省去了数据传输的时间,防止传输过程中可能出现的数据丢失问题以及一些不稳定的情况。晶锐与PGM Server建立安全数据交换通道,每隔5分钟扫描并下载测序仪新产生数据,当其检测到这批数据已经产生并且不再变化时,就会同步过来并且启动数据分析。

“准”是指专属流程、严格质控,主要体现在挑选致病基因的过程中,这是肿瘤伴随诊断中非常重要的一点。只有致病基因挑选准确,之后的药物推荐才能可靠。晶锐使用一代测序和QPCR对模型进行了验证。

“快”对于肿瘤诊断不是一个很大的问题,因为肿瘤相关的基因一般是十几个基因到一百多个基因之间,而且数据量差别并不是很大。一个批次32例肿瘤、17基因测序下机数据运行时间小于1个小时。

3218bbc0f17807aa5b2cf805a5ef67b1a0ba6d97

“可定制”是指多种Panel选择、自定义hotspot、本地知识库。由于晶锐使用的是私有云部署的方式,所以可以做一个很大的扩充,具体的扩充方式如上图所示。
相关文章
|
26天前
|
人工智能 安全 BI
2024年度云治理企业成熟度发展报告解读(一)云市场发展洞察
从2023年开始,阿里云携手埃森哲每年发布《云治理企业成熟度年度发展报告》,通过数据来解读企业在云上的稳定性、安全、效率、成本等方面的发展现状,并反映各行业头部客户的技术演进趋势。该报告已成为了解中国云计算行业发展趋势的重要参考。这次,埃森哲将带来最新出炉的2024年度发展趋势报告(导读版)解读。
2024年度云治理企业成熟度发展报告解读(一)云市场发展洞察
|
6月前
|
消息中间件 运维 监控
基于SaaS云部署、云计算的区域医院云HIS系统源码(运维管理+运营管理+综合监管)
医院云his系统采用主流成熟技术开发,B/S架构,软件结构简洁、代码规范易阅读,SaaS应用,全浏览器访问,前后端分离,多服务协同,服务可拆分,功能易扩展。多医院统一登录患者主索引建立、主数据管理,统一对外接口管理。
144 1
|
大数据 云计算
在线教育行业云上技术服务白皮书-在线教育行业云计算应用场景-某客户上云部署方案
在线教育行业云上技术服务白皮书-在线教育行业云计算应用场景-某客户上云部署方案
|
存储 机器学习/深度学习 运维
在线教育行业云上技术服务白皮书-在线教育行业云计算应用场景-阿里云大数据收集、存储与分析平台
在线教育行业云上技术服务白皮书-在线教育行业云计算应用场景-阿里云大数据收集、存储与分析平台
158 0
|
弹性计算 人工智能 Cloud Native
阿里云首家通过《可信云·云成本优化工具能力要求》评估,云原生企业 IT 成本治理方案助力企业 FinOps 落地
5 月 19 日,由中国信息通信研究院(以下简称“中国信通院”)和中国通信标准化协会联合主办的“2022 云管和云网大会”通过线上直播的形式成功召开。会上发布了《可信云•云成本优化工具能力要求 - 第1部分 原生工具》标准及首批评测结果。
阿里云首家通过《可信云·云成本优化工具能力要求》评估,云原生企业 IT 成本治理方案助力企业 FinOps 落地
|
云安全 运维 安全
传统企业业务上云基础安全防护
提供传统企业业务上云后,如何在云上构建网络全、主机安全、入侵检测、运维审计等可实操最佳实践。
传统企业业务上云基础安全防护
|
存储 编解码 分布式计算
【云栖号案例 | 医疗健康】华大基因上云 打造精准医疗应用云平台日志方案
基因数据产生的体量越来越大,超出了原有计算能力所能支持的范围。通过使用Maxcompute加速对人群结构的分析速度的进展,计算成本大幅降低至1000美金以内。
【云栖号案例 | 医疗健康】华大基因上云 打造精准医疗应用云平台日志方案
|
弹性计算 负载均衡 NoSQL
互联网行业构建高弹性系统
在互联网行业的业务发展中,很多业务具有突发性特点。互联网电商的秒杀、促销等活动,这类业务的特点是时间固定,但访问量不固定。除了提前升配之外,客户往往希望系统本身也能有自动弹性伸缩的能力。对于互联网教育的场景,由于存在放假和平时的区别,系统也需要有一定的弹性伸缩能力去应对高出平时几倍的压力,等访问减少时,业务系统能释放冗余的资源达到节约成本的目标。
互联网行业构建高弹性系统
|
云计算
阿里云行业解决方案之O2O:吃喝玩乐都在云上
O2O无疑是今年最热门的创业领域。手机叫个外卖已经再普通不过,美容、美甲等上门服务更是方兴未艾。但伴随业务量的增长,众多创业者开始意识到O2O其实是门“技术活”。如何构建简单、弹性、灵活的IT架构,成为企业必须面对的难题。
|
云安全 安全 容灾
阿里云安全肖力:云的六大安全基因助力企业构建智能化安全体系
传统的企业安全边界正在失效,无论企业数据部署在本地还是云上都会成为攻击的目标,看似铜墙铁壁的传统安全防御措施已经无法应对越来越智能化的攻击。基于云的原生安全能力及安全产品和服务,能够帮助用户构建从基础设施安全到应用安全的全方位多层次安全体系,保障用户资产安全及业务稳定性。
2297 0