什么是大数据?

本文涉及的产品
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介:   然而,什么是大数据?至今也没有一个比较权威的定义。  麦肯锡曾给出大数据的定义是:大数据是指大小超出了常规数据库工具获取、存储、管理和分析能力的数据集合。  维基百科也给出类似的定义:大数据指的是所涉及的数据量规模大到无法通过目前主流软件工具,在合理时间内达到撷取、管理、处理并整理成为帮助企业经营决策更积极目的的资讯。  一句话,大数据就是数据量大?!  我觉得,这句话说了等于没说,还容易让人误解。你以为数据量大才是大数据?

  然而,什么是大数据?至今也没有一个比较权威的定义。

  麦肯锡曾给出大数据的定义是:大数据是指大小超出了常规数据库工具获取、存储、管理和分析能力的数据集合。

  维基百科也给出类似的定义:大数据指的是所涉及的数据量规模大到无法通过目前主流软件工具,在合理时间内达到撷取、管理、处理并整理成为帮助企业经营决策更积极目的的资讯。

  一句话,大数据就是数据量大?!

  我觉得,这句话说了等于没说,还容易让人误解。你以为数据量大才是大数据?

  大数据(Big Data)的概念,其实早在上个世纪九十年代就已经提出。

  最初,大数据是特指由于需要处理的数据量过大,其所需要的计算能力已经超出了单台电脑的处理能力,因此工程师们必须要找到新的处理技术和方法,以便快速处理数据。比如,二手手机靓号交易平台要利用上百上千台电脑组建的集群系统中,实现海量数据的分布式存储和分布式计算,但这需要新的计算系统(比如Apache的开源系统Hadoop大数据平台系统)来实现。

  另一方面,随着互联网的发展,所谓数据也不仅仅是指保存在数据库中的排列整齐的结构化数据,也包含大量的非结构化和半结构化的数据(比如网页、图片、音频、视频等等),这些数据也同样蕴含着重要的信息,也属于大数据的范畴。

  所以,用数据本身的特征来定义,大数据可以理解为海量数据和复杂数据。

  大数据=海量数据 + 复杂数据

  其实,大数据并非一个确切的概念,就正如互联网的概念一样。互联网,不仅仅是一个计算机网络,其中有更丰富的内涵;大数据,也不仅仅是数据量大那么简单。

  在今天,大数据只是一个泛称,它可以是一种应用场景,也可以是一种技术(分布式技术),是一种方法(分析和挖掘方法),是一种工具(探索事物规律的工具),更是一种思维方式(大数据思维),等等。

  尽管,无法给大数据一个明确的定义,但这并不妨碍人们将这个概念应用到人类社会中的所有行业、所有领域中,以解决生活、工作、商业的问题。

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
Cannot access ‘androidx.lifecycle.HasDefaultViewModelProviderFactory‘ which is a supertype of ‘com.e
今天创建了个项目,突然出现了这样的问题,怎么处理都没用,网上找了一堆没发现答案,故此记录。
442 0
Cannot access ‘androidx.lifecycle.HasDefaultViewModelProviderFactory‘ which is a supertype of ‘com.e
|
SQL JavaScript 关系型数据库
号称下一代Node.js,Typescript以及go的orm的prisma 浅谈如何在nest.js中使用
号称下一代Node.js,Typescript以及go的orm的prisma 浅谈如何在nest.js中使用
号称下一代Node.js,Typescript以及go的orm的prisma 浅谈如何在nest.js中使用
|
Prometheus Cloud Native Linux
Linux|错误集锦|prometheus Error on ingesting samples that are too old or are too far into the future的解决
Linux|错误集锦|prometheus Error on ingesting samples that are too old or are too far into the future的解决
755 0
Linux|错误集锦|prometheus Error on ingesting samples that are too old or are too far into the future的解决
|
JavaScript 前端开发 开发者
【Web 前端】TypeScript 的内置数据类型有哪些?
【5月更文挑战第1天】【Web 前端】TypeScript 的内置数据类型有哪些?
|
存储 监控 JavaScript
在 Vue 中如何处理错误和异常情况?
在 Vue 中如何处理错误和异常情况?
348 3
|
Oracle 关系型数据库 Apache
Flink cdc报错问题之同步oracle报错如何解决
Flink CDC报错指的是使用Apache Flink的Change Data Capture(CDC)组件时遇到的错误和异常;本合集将汇总Flink CDC常见的报错情况,并提供相应的诊断和解决方法,帮助用户快速恢复数据处理任务的正常运行。
|
机器学习/深度学习
交通流量预测LSTM实战 详细教学计算机毕设
交通流量预测LSTM实战 详细教学计算机毕设
418 0
IT:银行类金融科技岗笔试习题集合—各大行(工商+建设+农业+浦发+招商+平安+人民+邮政银行)计算机信息科技岗笔试集合(包括计算机基础知识+网络+操作系统+数据库系统原理)
IT:银行类金融科技岗笔试习题集合—各大行(工商+建设+农业+浦发+招商+平安+人民+邮政银行)计算机信息科技岗笔试集合(包括计算机基础知识+网络+操作系统+数据库系统原理)
IT:银行类金融科技岗笔试习题集合—各大行(工商+建设+农业+浦发+招商+平安+人民+邮政银行)计算机信息科技岗笔试集合(包括计算机基础知识+网络+操作系统+数据库系统原理)
|
机器学习/深度学习 编解码 算法
异构图 Link 预测 理论与DGL 源码实战
异构图 Link 预测 理论与DGL 源码实战
异构图 Link 预测 理论与DGL 源码实战

热门文章

最新文章