案例| 用大数据预测登革热

本文涉及的产品
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介:


用手机数据(左图)预测登革热的流行范围比传统的扩散模型(右图)更为准确。图片来自《Impact of human mobility on the emergence of dengue epidemics in Pakistan》,该文发表于PNAS。


由于手机总是会自动连接到最近的信号发射塔,因此可以利用通话记录在某个特定的时间点对人进行定位,这一原理常常被法律界用来作为不在场证据或是定罪的依据。现在,哈佛大学公共卫生学院的研究人员发现了通话记录还可能具有拯救生命的功能:预测流行病的蔓延情况。


通过整合4000万巴基斯坦手机用户(占全国人口的22%)的通话记录和天气数据,哈佛的研究人员预测出了登革热的蔓延趋势。登革热是巴基斯坦很常见的一种可能致死的热带疾病。研究人员将2013年登革热病毒的传播轨迹和手机用户的出行模式进行了匹配,发现后者能相当准确地预测前者。流行病学系的助理教授,该研究的通讯作者 Caroline Buckee说:“相比于其它利用环境变量或人类交通的代替物(比如公路网络)的方法,这种方法能更加准确地预测出登革热可能会出现在哪里。”另一位博士后研究员,该研究的第一作者Amy Wesolowski补充说:“对于公路网络并不发达的低收入国家来说,手机数据对于追踪疫情的发展显得尤其重要。”


由于登革热既没有疫苗预防也没有有效的方法治疗,预测疫情爆发对于控制其蔓延至关重要。Buckee说:“做好充分的准备工作,即预测可能发生的时间地点,是我们可以做的为数不多的事情之一。”由于该疾病主要发生在城市地区,而城市地区的手机信号比较密集,因此非常适合用手机网络作为代替物来预测追踪登革热。Wesolowski表示,他们正在努力将这一发现介绍给巴基斯坦卫生防疫部门的官员。


哈佛大学的这项研究代表了到目前为止最大的用来分析预测人类流动性的通话记录数据集。这是和巴基斯坦第二大电信业务运营商Telenor合作完成的。同时,研究者们也尽了最大努力保护这些用户的隐私权。Buckee说:“这些手机通话记录都是匿名的,我们希望这项研究能成为将来公共卫生研究人员和电信行业继续合作的一个良好的先例。”



原文发布时间为:2015-11-09

本文来自云栖社区合作伙伴“大数据文摘”,了解相关信息可以关注“BigDataDigest”微信公众号

相关实践学习
基于Hologres轻松玩转一站式实时仓库
本场景介绍如何利用阿里云MaxCompute、实时计算Flink和交互式分析服务Hologres开发离线、实时数据融合分析的数据大屏应用。
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
相关文章
|
5月前
|
关系型数据库 MySQL 大数据
大数据新视界--大数据大厂之MySQL 数据库课程设计:MySQL 数据库 SQL 语句调优的进阶策略与实际案例(2-2)
本文延续前篇,深入探讨 MySQL 数据库 SQL 语句调优进阶策略。包括优化索引使用,介绍多种索引类型及避免索引失效等;调整数据库参数,如缓冲池、连接数和日志参数;还有分区表、垂直拆分等其他优化方法。通过实际案例分析展示调优效果。回顾与数据库课程设计相关文章,强调全面认识 MySQL 数据库重要性。为读者提供综合调优指导,确保数据库高效运行。
|
11月前
|
SQL 分布式计算 NoSQL
大数据-164 Apache Kylin Cube优化 案例1 定义衍生维度与对比 超详细
大数据-164 Apache Kylin Cube优化 案例1 定义衍生维度与对比 超详细
125 1
大数据-164 Apache Kylin Cube优化 案例1 定义衍生维度与对比 超详细
|
11月前
|
分布式计算 大数据 Linux
大数据体系知识学习(二):WordCount案例实现及错误总结
这篇文章介绍了如何使用PySpark进行WordCount操作,包括环境配置、代码实现、运行结果和遇到的错误。作者在运行过程中遇到了Py4JJavaError和JAVA_HOME未设置的问题,并通过导入findspark初始化和设置环境变量解决了这些问题。文章还讨论了groupByKey和reduceByKey的区别。
182 1
|
11月前
|
消息中间件 存储 druid
大数据-156 Apache Druid 案例实战 Scala Kafka 订单统计
大数据-156 Apache Druid 案例实战 Scala Kafka 订单统计
152 3
|
11月前
|
消息中间件 druid 大数据
大数据-153 Apache Druid 案例 从 Kafka 中加载数据并分析(二)
大数据-153 Apache Druid 案例 从 Kafka 中加载数据并分析(二)
137 2
|
11月前
|
存储 大数据 分布式数据库
大数据-165 Apache Kylin Cube优化 案例 2 定义衍生维度及对比 & 聚合组 & RowKeys
大数据-165 Apache Kylin Cube优化 案例 2 定义衍生维度及对比 & 聚合组 & RowKeys
160 1
|
11月前
|
消息中间件 分布式计算 druid
大数据-153 Apache Druid 案例 从 Kafka 中加载数据并分析(一)
大数据-153 Apache Druid 案例 从 Kafka 中加载数据并分析(一)
170 1
|
11月前
|
存储 SQL 分布式计算
大数据-142 - ClickHouse 集群 副本和分片 Distributed 附带案例演示
大数据-142 - ClickHouse 集群 副本和分片 Distributed 附带案例演示
943 0
|
11月前
|
存储 SQL 分布式计算
大数据-139 - ClickHouse 集群 表引擎详解4 - MergeTree 实测案例 ReplacingMergeTree SummingMergeTree
大数据-139 - ClickHouse 集群 表引擎详解4 - MergeTree 实测案例 ReplacingMergeTree SummingMergeTree
154 0
|
11月前
|
SQL 大数据 API
大数据-132 - Flink SQL 基本介绍 与 HelloWorld案例
大数据-132 - Flink SQL 基本介绍 与 HelloWorld案例
203 0

热门文章

最新文章