数据分析后遗症:大数据互联网隐私之殇

简介:
+关注继续查看

本文讲的是数据分析后遗症:大数据互联网隐私之殇,大数据已经成为预测社会与经济走向方面的绝对利器——然而其极高的信息使用量与综合分析流程恐怕会彻底抹杀如今我们最为看重的隐私权。

  随着企业间竞争日趋白热化,对数据的攫取与分析之强烈已经达到令人震惊的地步。迅速成长的数据收集业务开始以互联网用户的日常活动作为结论的支持材料,但这种无孔不入的疯狂探求令我们最个人化的行为都暴露在他人面前。

  除了在宏观上构建社交模式及经济走向,大数据还能根据个人用户不经意间生成的原始数据描绘出对方生活的状态。

  Target公司的客户关系分析工具借助大数据意外发现某位年轻女孩怀孕的秘密,而这一结论源自这位女孩在Target连锁店中的购物记录。尽管她(和她父亲)并没有向Target直接提供信息,但店面中的数据采集工具根据购买习惯推测出了她怀孕的事实,并以购物手册的形式向她推荐一系列相关产品——正是这本小册子让即将成为爷爷奶奶的两位家长目瞪口呆。

  Facebook与谷歌同大数据的关系

  Facebook的数据团队一直对网站上提供的发布信息进行分析,这种庞大数据量之下所蕴含的预测能力在深度与广度方面无人能及——这也成为研究人员、广告商以及各政府机构掌握状况的有力武器。

  该团队通过用户对于歌曲风格的偏好判断对方的当前关系状态,并通过此类数据预测更为广泛的社会行为模式。在某个例子中,数据团队尝试通过一种算法归纳世界各地人民的“幸福指数”,所得到的结果确实能与当时真实世界中的某些大事件进行印证。

  与此同时,谷歌公司在通过了引发无数争议的隐私政策修订之后,无处不在的互联网服务几乎令这家企业成为人类信息的总资源库,这就使得其信息为政府所用的日子为时不远。尽管最近谷歌刚刚通过网站对政府部门急于获取用户个人信息的举动表示抗议,但他们仍然指出未来谷歌会继续帮助国家掌握百姓的日常行为。

  各国政府与大数据

  世界各国政府对于个人数据的处理方法有所不同。美国政府正在采取措施,希望通过社交媒体收集个人资料,借以监控潜在的犯罪活动并改善国土安全保障工作。

  美国国务院最近还要求软件开发人员打造一款工具,借以更便捷地对来自谷歌、Facebook及Twiiter等网站的数据进行分析,最终达到服务国家的目的。这一决定显示出政府方面对于收集并使用个人数据的强烈意愿。

  而且国务院绝不是美国政府中惟一对个人资料紧追不放的机构——FBI甚至打算通过修改代码对社交媒体加以窃听。随着美国政府参与Stuxnet及Flame两款病毒制作的消息甚嚣尘上,很明显官方已经从网络监控中尝到了甜头,而在未来他们对个人数据分析的热情也必然会持续升温。

  但随着公民对于自身安全保障的迫切需要,这些监控活动很可能与隐私保护产生冲突,由此引发的矛盾与争论可能比单纯的隐私权话题更难以平息。

  大数据中的“大玩家”们如何对待个人信息

  数据的生成方式并不一致,很多大数据玩家都会刻意避开个人信息的介入,而不像谷歌和Facebook那样来者不拒。Factual公司就在数据分析业务中有意将个人信息加以剔除,其公关代表Kathryn Huff在解释这种差别时指出“本公司专注于秉持正确的数据收集及切入点。”

  然而与Factual不同,包括Spokeo在内的很多企业则毫无节操地直接进行个人数据交易,并在客户行为报告中加入很多令人难以接受的极端细节。举例来说,他们会在针对个人客户的档案中引用有关家庭成员及业余爱好的图片。这种规模化数据收集所产生的负面影响令人震惊,并可能在侵犯隐私权的同时降低企业的信用评分。

  美国联邦贸易委员会曾经对Spokeo这种人神共愤的数据收集方式处以罚款,但该公司依然我行我素,可谓记吃不记打。

  大数据收集如何应对COPPA(儿童在线隐私保护法案)

  COPPA,全称为儿童在线隐私保护法案,要求企业不得收集13岁以下儿童的在线数据及行为细节。但由于该法案的约束对象不包括政府机关及非营利组织,这就使得儿童的网络行为信息仍然在包括美国政府在内的众多机构面前暴露无遗。

  像Facebook与Collective Intellect这样的企业倒是属于法案约束的直接对象,但他们遵守规定的效果却很难令人信服。Facebook从技术层面上只允许13岁以上的用户建立账户,但事实上小朋友们利用各种方法避开了这一限制。另外,由于社交媒体自身有吸引年轻用户的意愿,所以改变现有数据收集方式才是解决问题的根本方法。

  未来会怎样?

  这些企业需要找到一条通过个人资料赚钱的道路,否则庞大的信息只会占用基础设施资源而无法带来任何收益。这对于普通用户及其隐私数据意味着什么?

  首先,我们应该清醒地意识到针对个人习惯所开展的广告攻势已然铺天盖地,而这一趋势在未来还将持续加剧。网站以营利为目的,因此在需要时他们肯定会把有价值数据作为利益交换的筹码。届时广告公司将以针对用户需求为噱头大肆宣传,收集并分析个人消费习惯的做法也将成为常态。

  此外,政府方面也会出于各种目的而继续整理并分析个人资料;虽然以Twitter为代表的一些社交媒体网站已经针对用户数据保护做出多方努力,但这种情况几乎不可能放缓乃至停止。换言之,开放性与流通性将成为个人资料的重要属性。

  大数据,特别是个人数据分析,正在一步步吞噬公民的隐私权。如果没有来自政府及谷歌、Facebook等各大主流网站的决定性政策变更,这种趋势将成为互联网的固有特性,并在未来继续保持下去。

作者: 赵赛坡

来源: IT168

原文标题:数据分析后遗症:大数据互联网隐私之殇


相关实践学习
简单用户画像分析
本场景主要介绍基于海量日志数据进行简单用户画像分析为背景,如何通过使用DataWorks完成数据采集 、加工数据、配置数据质量监控和数据可视化展现等任务。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
7天前
|
机器学习/深度学习 数据采集 边缘计算
大数据和数据分析:决策制定的新方式
大数据和数据分析:决策制定的新方式
57 0
|
16天前
|
消息中间件 分布式计算 物联网
大数据Spark物联网设备数据分析
大数据Spark物联网设备数据分析
22 0
大数据Spark物联网设备数据分析
|
16天前
|
SQL 分布式计算 数据挖掘
大数据Spark电影评分数据分析
大数据Spark电影评分数据分析
16 0
|
6月前
|
人工智能 大数据 分布式计算
大数据公共数据集上线,免费试用TB级数据分析
本教程基于大数据AI公共数据集(淘宝、飞猪、阿里音乐、Github、TPC等),通过DataWorks与MaxCompute快速完成大数据分析。
3172 2
大数据公共数据集上线,免费试用TB级数据分析
|
10月前
|
数据采集 数据可视化 架构师
数据分析案例-大数据相关招聘岗位可视化分析
数据分析案例-大数据相关招聘岗位可视化分析
160 0
数据分析案例-大数据相关招聘岗位可视化分析
|
10月前
|
分布式计算 数据挖掘 大数据
《如何使用大数据计算服务 MaxCompute进行数据分析》电子版地址
如何使用大数据计算服务 MaxCompute进行数据分析
87 0
《如何使用大数据计算服务 MaxCompute进行数据分析》电子版地址
|
11月前
|
弹性计算 分布式计算 数据可视化
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析(下)
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析
117 0
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析(下)
|
11月前
|
Web App开发 分布式计算 数据可视化
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析(上)
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析
164 0
【实验】阿里云大数据助理工程师认证(ACA)- QuickBI数据分析(上)
|
11月前
|
数据挖掘 大数据 BI
阿里云ACP大数据分析师公开课—快速攻克ACP大数据数据分析,扫码进领取学习资料!
0元免费 公开课;5天试题+2天直播;发放学习资料,支持学习问题答疑
阿里云ACP大数据分析师公开课—快速攻克ACP大数据数据分析,扫码进领取学习资料!
|
移动开发 监控 供应链
互联网行业的数据分析,到底在分析什么?
经常有小伙伴问:天天看你们说互联网数据分析,到底互联网数据分析在分析什么?今天给大家分享一下哦。 首先,所有的数据分析,都是围绕三个问题展开的: 监控现状,发现问题 分析原因,评估效果 预测走势,测试方案 但是在不同的场景,解决的问题不一样。 因此想知道互联网数据分析在分析什么,得弄清楚,所谓的“互联网”到底有哪些场景。笼统地说,有7个大场景。
502 1
互联网行业的数据分析,到底在分析什么?
推荐文章
更多