美国政府部门将启动大规模大数据部署

简介: 美国政府IT专家们表示,一旦大数据分析流程成功铺开,政府机关每年的财政预算能够节约达14%、具体数额达到5000亿美元。不过尽管已经有接近四分之一的政府IT管理者在新一轮投票中表示其所在机构已经着手建立至少一个大数据项目,但只有31%受访者相信所在机构能够真正实现大数据项目带来的潜在收益。

美国政府IT专家们表示,一旦大数据分析流程成功铺开,政府机关每年的财政预算能够节约达14%、具体数额达到5000亿美元。不过尽管已经有接近四分之一的政府IT管理者在新一轮投票中表示其所在机构已经着手建立至少一个大数据项目,但只有31%受访者相信所在机构能够真正实现大数据项目带来的潜在收益。上述数据来自最近发布的一份名为《智能化美国:大数据展望》的报告,由政府IT网络部门MeriTalk负责整理,采访了150位联邦政府IT专家。

根据报告得出的结论,政府方面预计在未来五年中需要把16%的年度总IT预算,也就是接近130亿美元,投入到大数据技术领域。大数据能够通过多种途径帮助政府机构达成既定目标,其中包括改进业务流程与执行效率(51%)、提升安全性(44%)以及做出趋势预测(31%)。

调查中的大部分受访者(70%)认为在未来五年中,成功运用大数据技术将成为联邦政府实现业务目标的关键性前提。

美国宇航局首席技术官Sasi Pillay博士在一次在线网络研讨会上做了发言,勾勒出利用分析机制处理大规模数据将给政府运营带来的改进。宇航局方面目前已经在其气候模拟中心内保存并处理与气候及天气密切相关的大量数据,该中心同时为宇航局的科学家及工程师们提供超级计算资源。气候模拟中心的官员们希望在大数据的帮助下减少测试数量、增加计算化模型。这样一来,科学家们就能够以直观方式掌握数据差异与异常状况。宇航局方面利用这种方式节约下大量工作时间及数十亿美元运营成本,Pillay指出。

大数据的另一大发挥舞台在于多级区域数据,旨在创建一套足以帮助试飞员们应对各类不同自然状况的新机制,Pillay解释道。这套方案的思路是汇总大量数据并将其通过特定方法加以整合,技术人员能够借此理解飞机与引擎在不同自然状况下的实际表现。

“美国宇航局正努力收集信息,并始终关注如此将这些信息转化为实际效益,”Pillay在此次网络研讨会上表示。“我们鼓励民间科学人士通过Data.gov网站分享数据。我们正在想办法将这些信息转化为数字化格式,”她告诉我们。“要真正利用这些数据还需要时间,这是一项长远发展目标。希望我们最终能够做到物尽其用,从而使这些数据成为未来科学探索道路上的指导。”

“用于提高政府机关大数据工作效率的“大数据组件”将“把自己的触角伸向元数据领域,且很可能采用标签化处理方式,”EMC公司政府首席技术官Rich Campbell在此次网络研讨会上指出。

根据这份报告汇总的信息,目前已经有26%的政府数据具备标签、23%的政府数据经过分析处理。报告同时指出,联邦政府IT高管们认为机关单位应该将数据管理比例再翻一倍,即将标签化数据比例提升至46%、数据分析比例则增加到45%。

在大数据的长期影响方面,有69%的调查受访者表示大数据将帮助政府以更出色的状态处理日常事务。

受访者们普遍认为大数据分析机制带来的收益在高级政府事务领域体现得尤其明显。54%的受访者认为军事/情报、监视以及侦察等将成为大数据的首要受益对象;战争欺诈、损耗以及资源滥用位居次席(48%);运输基础设施管理则位列第三(27%)。

EMC公司的Campbell表示“新趋势将给一个又一个政府机构带来变化。多数政府部门将大数据项目的时间框架制定为未来六到九个月之内,大规模项目则将于未来十八到三十六个月内启动。”


原文发布时间为:2013-09-28


本文来自云栖社区合作伙伴“大数据文摘”,了解相关信息可以关注“BigDataDigest”微信公众号

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
相关文章
|
存储 机器学习/深度学习 算法
大数据时代下的智能洞察:大规模数据处理的创新与应用
在信息爆炸的时代,大规模数据处理成为了科技领域的核心挑战之一。本文将探讨大规模数据处理的定义、创新技术和广泛应用,并阐述数据驱动的决策和洞察对现代社会带来的巨大影响。
603 3
|
分布式计算 DataWorks MaxCompute
DataWorks中odps到容器部署starrocks的单表同步遇到写入问题
【1月更文挑战第6天】【1月更文挑战第29篇】DataWorks中odps到容器部署starrocks的单表同步遇到写入问题
264 3
|
分布式计算 资源调度 Hadoop
大数据-80 Spark 简要概述 系统架构 部署模式 与Hadoop MapReduce对比
大数据-80 Spark 简要概述 系统架构 部署模式 与Hadoop MapReduce对比
575 2
|
分布式计算 资源调度 大数据
【决战大数据之巅】:Spark Standalone VS YARN —— 揭秘两大部署模式的恩怨情仇与终极对决!
【8月更文挑战第7天】随着大数据需求的增长,Apache Spark 成为关键框架。本文对比了常见的 Spark Standalone 与 YARN 部署模式。Standalone 作为自带的轻量级集群管理服务,易于设置,适用于小规模或独立部署;而 YARN 作为 Hadoop 的资源管理系统,支持资源的统一管理和调度,更适合大规模生产环境及多框架集成。我们将通过示例代码展示如何在这两种模式下运行 Spark 应用程序。
980 3
|
SQL 分布式计算 大数据
大数据-168 Elasticsearch 单机云服务器部署运行 详细流程
大数据-168 Elasticsearch 单机云服务器部署运行 详细流程
624 2
|
存储 分布式计算 安全
MaxCompute Bloomfilter index 在蚂蚁安全溯源场景大规模点查询的最佳实践
MaxCompute 在11月最新版本中全新上线了 Bloomfilter index 能力,针对大规模数据点查场景,支持更细粒度的数据裁剪,减少查询过程中不必要的数据扫描,从而提高整体的查询效率和性能。
|
资源调度 分布式计算 大数据
大数据-111 Flink 安装部署 YARN部署模式 FlinkYARN模式申请资源、提交任务
大数据-111 Flink 安装部署 YARN部署模式 FlinkYARN模式申请资源、提交任务
638 0
|
分布式计算 运维 DataWorks
MaxCompute产品使用问题之数据如何导出到本地部署的CK
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
295 1
|
存储 SQL 分布式计算
MaxCompute 在大规模数据仓库中的应用
【8月更文第31天】随着大数据时代的到来,企业面临着海量数据的存储、处理和分析挑战。传统的数据仓库解决方案在面对PB级甚至EB级的数据规模时,往往显得力不从心。阿里云的 MaxCompute(原名 ODPS)是一个专为大规模数据处理设计的服务平台,它提供了强大的数据存储和计算能力,非常适合构建和管理大型数据仓库。本文将探讨 MaxCompute 在大规模数据仓库中的应用,并展示其相对于传统数据仓库的优势。
495 0
|
运维 监控 大数据
部署-Linux01,后端开发,运维开发,大数据开发,测试开发,后端软件,大数据系统,运维监控,测试程序,网页服务都要在Linux中进行部署
部署-Linux01,后端开发,运维开发,大数据开发,测试开发,后端软件,大数据系统,运维监控,测试程序,网页服务都要在Linux中进行部署