
大数据”——如果你反感这一用语的话,你并不是唯一有这种想法的人,但我认为我们如今已经接受了它——最激动人心的一个前景是,规模日益庞大的数据搜集活动,借助于现代化的数据处理和模式识别算法,将让我们对周围这个世界具有更为全面的认识,尤其是对人类行为。不幸的是,这同样也是大数据最令人担心的地方。
目前,大数据和隐私似乎是一对不共戴天的死敌。个人数据可以降低汽车保险支出,但代价是你的个人隐私。它可以提供至关重要的公共卫生数据——通过获取敏感且私密的个人健康信息。它可以帮助警察追踪犯罪分子——通过一种在实践中被认为遭到滥用的技术,创建面部识别“圆形监狱”(panopticon)。它可以根据你发布到网上的所有照片,对你的个人特征做出一个详细描述——即便你根本不希望这一切发生。
这些并不是仅仅是纯粹理论层面的担忧。据《纽约时报》报道:
由于政府机构监管不力,数十年来数据挖掘公司、数据代理公司、数据中间商数不断危害公民隐私,如今他们又将隐秘的个人数据分类带到一个全新的水平。他们已经制作了性侵受害者名单以及性病患者的名单。此外,还有阿尔茨海默氏病、痴呆症及艾滋病患者的名单,阳痿和抑郁症患者名单。
与此同时,还有“冲动型买家”名单;“易受骗者”名单:即容易上当受骗的消费者,研究发现这个人群易于遭受“基于弱点的营销宣传”的影响。
可以想见,如果这种名单是来自于那些无意中显露出他们易受数据披露影响的人,这会带来什么样的严重后果。例如,通过算法可解读的Facebook帖子,再对比发帖者其他所有信息,可以作为他们本不想披露的秘密的证据。
这基本上存在两个问题。一是数据的匿名化和安全性没有任何一个标准。有些搜集和发布数据的机构会对数据进行匿名化处理,确保它们的安全,但这些举动让人感觉更像是权宜之计,“经过匿名化处理”的数据极少。例如,今年早些时候纽约出租车数据就未经过妥善的匿名化处理。
还有一个更深层、也更为重要的问题:人们是否有权知道他们的数据何时被别人搜集?一旦发生这种状况,是个人还是搜集方拥有这些数据?下面,我就来介绍一下麻省理工学院教授阿莱克斯·彭特兰(Alex Pentland)及其提出的“数据新政”(New Deal on Data):
从整体上讲,我们现在拥有的数据可以帮助减少环境污染,帮助创建透明政府,帮助应对流行疾病,当然也有助于提高工人的工作效率,让顾客获得更好的服务。但很显然,有人或有公司可以滥用数据…“新政”可以让人们知道自己有哪些数据正在被搜集,进而可以选择加入或退出。想象一下,如果你的仪表板可以显示你的居室掌握了哪些信息,以及分享了哪些信息,你可以将它关闭或打开…透明是关键。正在搜集的有关你的数据能形成对你生活的相当全面的认识,我认为一些公司并未意识到“抓取所有数据”战略的成本非常高。
然而,从实际情况来看,这种“新政”预示着创新和监管之间漫长而令人悲伤的战斗故事将掀开一个新的篇章。我并不反对后者(即监管),但相对于前者(即创新)的快速演变,我只是对它的表现经常感到失望罢了。毋庸置疑,数据搜集能力的指数级增长可以给我们带来巨大的好处,但同样不容置疑的是,所有人都极为担心科技对隐私发起的那场不可阻挡(几乎出于偶然)的战争,我们正面临着一场灾难,或者说距离大声疾呼更严格的监管只有一步之遥。
若想解决这个问题,科技行业理应从一开始就走到最前面,定义和执行对数据进行匿名化处理的技术标准。(如果这真的成为一个新的子行业,我丝毫不会感到吃惊。)但一个更好的结果是,大公司在一个性质相当于“新政”的自愿协议上达成一致,希望可以预先阻止民众呼吁加强监管的行动,而且宜早不宜迟。我认为科技行业并未充分意识到数据隐私和缺乏隐私对公众的危害。如果我们不认真对待这件事,那无异于是在玩火。CDA数据分析师培训官网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
“纲举目张,执本末从。”若想在数据分析领域有所收获,一套合适的学习教材至关重要。一套优质且契合需求的学习教材无疑是那关键 ...
2025-06-092025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-05-27CDA数据分析师证书考试体系(更新于2025年05月22日)
2025-05-26解码数据基因:从数字敏感度到逻辑思维 每当看到超市货架上商品的排列变化,你是否会联想到背后的销售数据波动?三年前在零售行 ...
2025-05-23在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27