京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代带来喜忧参半,数据发展正面临转折点
近年来,大数据已经覆盖了许多领域,包括互联网领域。许多应用和平台热衷于搜集用户的信息。而在近日举行的SXSW(South by Southwest,西南偏南)大会上,专家们却表达了对于数据会歧视用户的担忧。
会上,独立隐私安全专家Ashkan Soldani提及了IBM的一款能够计算“恐怖主义得分”的软件。这款软件的目的是通过用户数据,计算从叙利亚来到欧洲的人们参与恐怖活动的概率。
大数据(bigdata)一词越来越多地被提及,人们用它来描述和定义信息爆炸时代产生的海量数据,并命名与之相关的技术发展与创新。但是,在大数据发挥重要作用的同时,也产生了一系列问题,给人们造成了困扰。
一、许多软件因数据歧视用户,造成诸多问题
目前,许多企业都会通过软件或应用搜集用户信息。在大数据时代,这种做法是无可厚非甚至是必要的,但是,用户数据可能会使用户遭到歧视,甚至造成滥用。
比如,电脑投放求职广告时,就会产生歧视行为。去年,卡耐基梅隆大学的研究人员通过一款名叫AdFisher的工具,对其第三方网站上的广告定向投放过程进行了追踪。结果表明,当谷歌判定求职者为男性时,为其推送高新主管职位消息的概率远大于同等条件的女性求职者。
记者Julia Angwin说:“你可能并不知道你为什么没有得到那份工作,你或许永远不会知道,其实是因为数据歧视了你”。
对此,AdFisher的开发者表示:“我认为,我们的发现揭露了目前广告生态中开始浮现的诸多歧视和不透明现象。从社会的角度来看,它很值得担忧”。
不仅是在工作方面,就连社交软件都会因为数据歧视用户。美国约会应用Tinder的付费版Tinder Plus推出后,其定价的差异化引发了争议。在美国的用户,18岁到29岁只需9.99美元,但是超过30岁的用户则需支付19.99美元。而处在英国地区的用户,18岁至27岁只需支付3.99英镑,而超过28岁就必须支付14.99英镑。
由于这样的定价,关于Tinder歧视“大龄未婚青年”的言论一时蔓延开来。对此,Tinder副总裁的解释是,年轻用户是高频使用者,但缺乏金钱,定价较低是为了刺激其购买欲。而大龄用户对价格或许敏感度更低,所以愿意购买服务。因此,定价差异化是基于公司测算,并非年龄歧视。
不管这些应用是出于怎样的目的,都或多或少地带有歧视色彩,并且大数据有泄露用户隐私之嫌。一份研究大数据影响的白宫报告中写道:“我们长期坚持的公民权利保护政策对居民信息如何在住房、信用卡、雇佣、健康、教育和交易市场等方面使用有严格的限制,而数据分析技术有可能会击溃这一防线”。
研究者指出,对于企业追踪用户的过程以及投放广告的算法有一定的了解,对人权组织及监管机构来说,是相当重要的。当然,企业也应该采取一些相关的措施,消除数据对用户带来的歧视。
大数据是在互联网时代不可避免的发展趋势,但同时,它产生的问题也让人们有些恐慌。
二、大数据发展正面临转折点,需努力趋利避害
大数据的意义就在于,从庞杂的数据背后挖掘并分析用户的行为习惯与喜好,从而找出更符合用户“口味”的产品和服务,并结合用户需求有针对性地调整和优化自身。
这种作用对于当今企业来说,是极其重要的,其商业价值大致体现在四个方面。
大数据可以实现客户群体细分,并为每个群体量身定制特别的服务;大数据可以对现实环境进行模拟,发掘出新的需求并使投资回报率有所提升;大数据可以加强部门之间的联系,提高生产链条与管理链条的效率;大数据可以使服务成本降低,找出隐藏线索,对产品和服务进行创新。
对于社会来说,大数据的发展也是有诸多好处的。大数据定理表明,在试验不变的条件下,重复试验过程多次。在大量重复中,会呈现出几乎必然的统计特性。
随着计算机处理能力的增强,获得的数据量越大,挖掘出的价值就越多。如果银行能够及时发现风险,社会经济将越发强大;如果医院能够及时发现疾病,我们的身体会更加健康;如果通信公司能够降低成本,我们的话费将更加实惠……
以上情况,都可以通过大数据的不断积累和不断分析实现。通过这一过程,我们可以发现规律,从而实现更好的未来。
但是,任何事物都有两面性,大数据时代所产生的问题也同样不少。
第一,数据不够安全。无论是企业还是个人,在实践过程中都会或多或少地产生数据。这些数据在当今时代并不安全,会有很多方法使它们泄露。
第二,数据泄露产生不平等。对于用户来讲,数据是一笔财富,但是遭到了别人的窃取,而自己并未得到任何收益,这对于用户来说是不公平的。
第三,用户隐私问题。当用户在网上注册信息后,这些信息很有可能已经被扩散,当用户收到一些莫名其妙的邮件、电话、短信时,其实用户的各种信息早已被非法的商业机构贱卖了。
无意中拍的照片,可能会使人一夜成名。用户的想法、行为、都可能被商家记录在案。人们担心身份被盗用,担心数据造假,害怕数据框定,反感数据的不公平造成的歧视。
要解决这些问题,需要克服许多困难,面临巨大的挑战。虽然企业可以更加细致地去检验他们的系统和流程,但是依然不能完全解决问题。通常数据驱动的决策都比较隐蔽,即使产生威胁,也不会被轻易发现。
任何的领域都需要统一,但是大数据行业尚不能立法,因为大数据趋势变化多端,无法掌握立法所面临的全部背景。
业内专家认为,有必要在计算机课程中增加数据伦理教育,并且更改有歧视倾向的计算机程序。尽管不能完全解决问题,但也能起到一定的作用。
马云说:“很多人还没搞清楚什么是PC互联网,移动互联网来了,我们还没搞清楚移动互联的时候,大数据时代又来了”。不管是喜是忧,大数据时代已经降临。
哈佛大学社会学教授加里•金说:“这是一场革命,庞大的数据资源使得各个领域开始了量化进程,无论学术界、商界还是政府,所有领域都将开始这种进程”。现在的大数据领域正面临一个转折点,努力的方向决定着其属性的发展。我们应该尽量消减其负面影响,让大数据发挥其正面作用,从而更好地为人类服务。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04在数字化转型进入深水区的今天,企业对数据的依赖程度日益加深,而数据治理体系则是企业实现数据规范化、高质量化、价值化的核心 ...
2026-03-04在深度学习,尤其是卷积神经网络(CNN)的实操中,转置卷积(Transposed Convolution)是一个高频应用的操作——它核心用于实现 ...
2026-03-03在日常办公、数据分析、金融理财、科研统计等场景中,我们经常需要计算“平均值”来概括一组数据的整体水平——比如计算月度平均 ...
2026-03-03在数字化转型的浪潮中,数据已成为企业最核心的战略资产,而数据治理则是激活这份资产价值的前提——没有规范、高质量的数据治理 ...
2026-03-03在Excel办公中,数据透视表是汇总、分析繁杂数据的核心工具,我们常常通过它快速得到销售额汇总、人员统计、业绩分析等关键结果 ...
2026-03-02在日常办公和数据分析中,我们常常需要探究两个或多个数据之间的关联关系——比如销售额与广告投入是否正相关、员工出勤率与绩效 ...
2026-03-02在数字化运营中,时间序列数据是CDA(Certified Data Analyst)数据分析师最常接触的数据类型之一——每日的营收、每小时的用户 ...
2026-03-02在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27在数字化时代,企业积累的海量数据如同散落的珍珠,若缺乏有效的梳理与分类,终将难以发挥实际价值。CDA(Certified Data Analys ...
2026-02-27在问卷调研中,我们常遇到这样的场景:针对同一批调查对象,在不同时间点(如干预前、干预后、随访期)发放相同或相似的问卷,收 ...
2026-02-26在销售管理的实操场景中,“销售机会”是核心抓手—— 从潜在客户接触到最终成交,每一个环节都藏着业绩增长的关键,也暗藏着客 ...
2026-02-26在CDA数据分析师的日常工作中,数据提取、整理、加工是所有分析工作的起点,而“创建表”与“创建视图”,则是数据库操作中最基 ...
2026-02-26在机器学习分析、数据决策的全流程中,“数据质量决定分析价值”早已成为行业共识—— 正如我们此前在运用机器学习进行分析时强 ...
2026-02-25在数字化时代,数据已成为企业决策、行业升级的核心资产,但海量杂乱的原始数据本身不具备价值—— 只有通过科学的分析方法,挖 ...
2026-02-25