
大数据时代的结构和解构_数据分析师
很多人都知道,数字世界的发展和黑客非常有关系。比如微软的比尔·盖茨就做过黑客,最新的标志性人物Facebook的扎克伯格也干过这个事儿。Facebook早期的版本Facemash.com就偷偷地接入了哈佛大学的学生数据库,获取了学生证件照。扎克伯格让同学们根据这些照片投票选美,很是热闹了一阵子。
来自华中科技大学的几个学生也是很彻底地模仿了扎克伯格一回:他们设置了一个名为hust-facemash.com的网站,同样是偷偷摸摸地侵入学校的HUB(华中科技大学公共信息服务平台),把一大堆的女同学照片放到网上让人“选美”。与当年的Facemash所引发的舆论抨击一样,华中科大的这个Facemash同样引来了不少的担忧和批评。
核心问题就是“隐私”。担忧者认为,在学生档案里,不仅有照片,还有各种其他信息,比如电话住址之类。今天这个Facemash只是公布了照片,但其他信息在这些年轻人侵入系统后必然被一览无遗。这又怎不让人担心呢?而那几个学生声称,他们做这个东西的动机只是想提醒一下校方:嘿,你们的网络系统安全弱爆了!
动机论是很不靠谱的,因为谁也不知道他们在倒腾这玩意儿时究竟是抱着善意提醒的目的呢,还是恶搞玩上一玩,抑或想成为中国的扎克伯格?但结果是很明显的,不仅侵犯到了人家的隐私,而且对那些女孩来讲,自家照片在自家从未首肯的情况下被别人拿去和其他女孩子放在一起评头论足,总不是件令人愉快的事。
如果说中外两个Facemash的后果还不算太严重的话,那么,另外几起用户数据库被侵入就很严重了。韩国最大的社交网站Cyworld遭入侵,成为韩国取消实名制的动因之一。不久前,美国最大的职业社交网站Linkedin遭入侵,600万用户密码被公布在一个论坛上。中国亦有类似事件,据称波及千万用户之巨。我们把很多东西放在网上,而这些东西的安全性,看来很值得担忧。
这已经不再是隐私那么简单了。数字经济的高速发展,使得很多事的效率都在提高,当然也会带来一些负面效应。而在这诸多负面效应中,在我看来,最大的莫过于,其实系统是很脆弱的。
我们必须承认,依托于网络,每个人之间的“距离”变得更近了,我们越来越成其为一个整体。但重点就是这个“依托网络”。服务器记载着我们太多的东西,这个整体变得越来越结构化,只要攻破其中一点,其整体就会出现剧烈的动荡,受侵害人口动辄数十乃至数百万。过去的一个银行体系的被侵入和今天(假定的)Facebook被侵入,后果简直是天壤之别。
互联网诞生之初,走的就是“去中心化”道路,免费的网络服务器系统阿帕奇的构想,就是在美国遭受斩首式攻击时,有其他节点可以迅速补上成为中心控制。但这个互联网从web1.0、web2.0一路走来,进入大数据时代后,大量的用户数据被储存在服务器端。是的,节点越来越趋去中心化,但数据却越来越中心化。我们已经“让渡”了一些很重要的东西给机器,但机器,却并不牢靠。
加强安全性是一个方法。但正如福尔摩斯的创造者柯南道尔在《跳舞的小人》里写道:有人发明,就有人看懂。再强的安全体系,都有被侵入的可能。而之所以很多看似松松垮垮的系统没有被侵入的原因其实很简单:不值得。解密是有成本的,但如果标的物诱惑足够,成本便会相对变得小很多。又有什么样的系统是100%的安全呢。数据越来越集中化,使得这个标的物的诱惑,变得越来越大。
加强对黑客行为的处罚也是一个方法。华中科技大学的那几个学生会面临什么样的惩处尚不知晓,扎克伯格可是因为Facemash领了哈佛的留校察看处分的。一些后果并不严重的行为,小小惩戒一下即可。但类似Cyworld和Linkedin的被入侵,一个警告是完全没有用的。
不过,话也要说回来。数据集中化加强了整个社会的结构化,体系会变得越来越有利于既得利益者、掌权者和有钱人。漏洞的存在,对当事人是一种不幸,但对整个社会而言,或许又是一种不幸中的大幸:反抗成为一种可能。哈维尔所谓“无权势者的权力”,在今天这个社会,大抵就会具象成如此吧。
波澜壮阔的基于数据的结构和反抗(或又可称之为解构)在大数据时代已经悄然登场。人类社会,终归是在矛盾中一路前行的。但这种结构或者反抗,最终是否会彻底失控,谁也不知道。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27数据分析在当今信息时代发挥着重要作用。单因素方差分析(One-Way ANOVA)是一种关键的统计方法,用于比较三个或更多独立样本组 ...
2025-04-25CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-25在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-24以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《刘静:10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda ...
2025-04-23