大数据时代我们还有隐私吗-CDA数据分析师官网

热线电话：13121318867

首页精彩阅读大数据时代我们还有隐私吗

大数据时代我们还有隐私吗

2016-08-10

大数据时代我们还有隐私吗

大数据对个人隐私权的影响。怎样保护网络隐私权？

随着数字信息技术的不断发展，“网络匿名”有可能会变成“数学上不可能”的事。

1995年，欧盟出台的隐私法例将“个人资料”定义为可以直接或间接识别一个人的信息。很显然，当时立法者考虑的是那些带有身份标识号的文件资料之类的东西，这些标识号就好像人的姓名，而立法者们希望它们可以得到保护。

如今，“个人资料”这一定义所包含的内容已经远远超出当年那些立法官员的想象，甚至可以轻易地超过18年前他们通过这项法例时整个世界的数据量。

来看看到底发生了什么。首先，这个世界每年所创造的数据量在以指数形式增长，去年，这一数字则达到了2.8ZB(1ZB =10244GB)，听起来就很可怕的数字，而且据知名信息行业咨询服务商IDC称，这一数字将在2015年翻一番。此外，这些数据中的3/4是由个体人在创造或移动数字文件时贡献的。举例来说，一个标准的美国上班族每年可以贡献180万MB的数据量，平均每天则有约5000MB，这其中包括下载的电影、文档、电邮以及这些数据通过移动或非移动互联网传播时所产生的附加数据量。

尽管这其中的大部分数据都是不可见的，似乎也并不携带任何个人信息，但事实并非如此。现代数据科学已经发现几乎任何类型的数据都能用来识别创造它的人，就好比指纹一样。比如说你在网上下载的电影、你的手机发出的定位信息，甚至是你被监控摄像机所拍下来的步态都可以用来识别你。实际上，数据越多，其中可以称得上隐私的就越少。普林斯顿大学的计算机科学家阿尔文德·纳拉亚南(Arvind Narayanan)称，只要有合理的商业动机来推动数据挖掘的进程，任何形式的隐私都是“算法上不可能”（algorithmically impossible）的。

可以说，我们已经在这条不归路上越走越远。那些以往被我们认为是个人资料的信息——姓名或者信用卡号——如今都已经被安客诚(Acxiom)公司这样的数据代理商用作交易，它拥有500多万名分布在世界各地的消费者的个人信息。人们在填写了某些调查表或者注册了一些服务后，相应的数据就进入了公共领域。这也是这些代理商的数据来源。

安客诚可以利用一些信息来推测你的生活方式、兴趣爱好和日常活动，比如你的汽车品牌和使用时间、你的收入和投资状况、你的年龄、受教育程度以及邮政编码。所有这些信息可以将你归类为70种不同的“PersonicX”集群中的一个。除此之外，你最近有离过婚吗，或者你刚刚变成了一名空巢老人？这些“人生大事”更可以将一个人从一个消费阶层转移到另一个，而这正是安客诚及其广告客户的关键兴趣所在。安客诚称其可以通过分析数据来预测3000种不同的行为及心理倾向，比如说一个人会在某两个品牌间做出怎样的选择。

虽说听起来很厉害，但这些数据代理商如今已经被认为是过时的了，尤其是跟Facebook这样的互联网公司相比。Facebook已经可以实现对个人信息收集的自动化与实时化，其首次公开募股时的财务档案显示，Facebook上每位用户的图片和视频资料数据量约为111MB，而Facebook的用户数如今已经超过了10亿，这可是整整100PB(1 PB = 10242 GB)的个人信息数据！在一些法律案件中，Facebook所记录的数据也派上了用场，其中包括涉案人发过的文字信息、点过“赞”的东西以及所用过的电脑的IP地址等，这些资料加起来足有800页，这800页就又给每位用户增加了几MB的数据量。

线上和线下的数据如今正在逐步融合，进而帮助营销人员更精准地进行广告投放，这也是众多“数字隐私”拥护者的烦心事。今年二月，Facebook宣布与包括安客诚在内的多家数据代理商展开合作，通过整合各自的数据资源来构造现实世界与虚拟网络之间的联系。一个月后，安客诚的首席科学官在一次投资者会议上称他们的数据已经与全美90%的社会档案建立了链接。

这些数据往往被描述为“在某种程度上具有匿名性”，但是牵涉到的信息越多，这样的说法就越显站不住脚。就拿移动通信运营商来说，他们会记录用户的位置和手机号码，然后再将这些综合数据卖给商家。尽管位置数据的匿名化是可以实现的，但是来自MIT的伊夫·亚历山大(Yves-Alexandre de Montjoye)和塞萨尔·A·伊达尔戈(César A. Hidalgo)却发现只要通过同一手机的四个不同的位置数据点就可以精确定位其拥有者。不光是移动通信运营商，你所用的浏览器也会“出卖”你的个人信息，就连最近刚刚兴起的可穿戴设备（如Google Glass）也被认为会引起隐私担忧。

毫无疑问，可以获得的个人大数据量越多，其中的信息量就越大。只要拥有了足够多的数据，我们甚至可能发现有关于一个人的未来信息。去年，来自美国罗彻斯特大学的亚当·萨迪克(Adam Sadilek）和来自微软实验室的工程师约翰·克拉姆(John Krumm)发现他们可以大致预测一个人未来可能到达的位置，最多可以预测到80周后，其准确度高达80%。为此，他们收集了32000天里307个人和396辆车的GPS数据并建造了一个“大规模数据集”。

两人想象了一下这一研究成果的商业应用，他们说到时候会出现这样的广告：“需要理发吗？四天后你就会在这家发廊周围100米内，届时它将会有优惠活动哦！”

这两人还为他们的系统起了一个名字——“遥远未来”(Far Out)，没错，这也正是大数据时代下的个人信息将带我们去的地方。

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试教材；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试题库；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

▷ 想了解CDA院校合作，点击>>> “院校合作” 了解咨询CDA院校合作；

大数据数据挖掘

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇回归系列（一）| 怎样正确地理解线性回归

下一篇2020美国总统竞选大戏开锣，川普当选的奇迹会再发生吗？

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

京公网安备 11010802034615号经营许可证编号：京B2-20210330

联系电话：13321103290 (微信同号)

客服在线

立即咨询

客服在线

立即咨询

免密码登录

提交首次登录验证后自动注册

大数据时代我们还有隐私吗

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

【CDA干货】金融行业运营风险监测：核心统计分析方 ...

【CDA干货】基于数据分析的财险潜在客户挖掘与精准 ...

从“杂乱数据”到“分析资产”：CDA数据分析师视角 ...

CDA持证人专访：何显臻谈餐饮行业数据分析与生产管 ...

【CDA干货】如何利用统计学方法开展数据分析：流程 ...

从“数据描述”到“业务预判”：CDA数据分析师视角 ...

【CDA干货】箱线图上下限计算原理、标准流程与异常 ...

【CDA干货】MySQL固定时间间隔数据查询：语法原理、 ...

从“杂乱信号”到“有序资产”：CDA数据分析师视角 ...

CDA持证人专访：周婧博谈会计行业数据分析与经营诊 ...

【CDA干货】问卷调查卡方检验：原理、前提与实战应 ...

从“整体波动”到“因子归因”：CDA数据分析师视角 ...

【CDA干货】单因素方差分析：三组及以上独立样本的 ...

【CDA干货】次日付费留存计算方法、统计口径与业务 ...

从“点状静态”到“时序动态”：CDA数据分析师视角 ...

CDA持证人专访：王晓琳谈数据分析备考与秋招实战经 ...

【CDA干货】用户决策流程全解析：核心环节、影响因 ...

从“标签”到“人”：CDA数据分析师视角下的用户画 ...

【CDA干货】透视表跨表数据应用原理与实战方法 ...

【CDA干货】正态分布异常事件识别与处理方法：数据 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载

大数据时代 我们还有隐私吗

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

【CDA干货】金融行业运营风险监测：核心统计分析方 ...

【CDA干货】基于数据分析的财险潜在客户挖掘与精准 ...

从“杂乱数据”到“分析资产”：CDA数据分析师视角 ...

CDA持证人专访：何显臻谈餐饮行业数据分析与生产管 ...

【CDA干货】如何利用统计学方法开展数据分析：流程 ...

从“数据描述”到“业务预判”：CDA数据分析师视角 ...

【CDA干货】箱线图上下限计算原理、标准流程与异常 ...

【CDA干货】MySQL固定时间间隔数据查询：语法原理、 ...

从“杂乱信号”到“有序资产”：CDA数据分析师视角 ...

CDA持证人专访：周婧博谈会计行业数据分析与经营诊 ...

【CDA干货】问卷调查卡方检验：原理、前提与实战应 ...

从“整体波动”到“因子归因”：CDA数据分析师视角 ...

【CDA干货】单因素方差分析：三组及以上独立样本的 ...

【CDA干货】次日付费留存计算方法、统计口径与业务 ...

从“点状静态”到“时序动态”：CDA数据分析师视角 ...

CDA持证人专访：王晓琳谈数据分析备考与秋招实战经 ...

【CDA干货】用户决策流程全解析：核心环节、影响因 ...

从“标签”到“人”：CDA数据分析师视角下的用户画 ...

【CDA干货】透视表跨表数据应用原理与实战方法 ...

【CDA干货】正态分布异常事件识别与处理方法：数据 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载

大数据时代我们还有隐私吗