京公网安备 11010802034615号
经营许可证编号:京B2-20210330
另一个视角看大数据 如何把数据变成真正的价值
大数据是当下最时髦的话题之一,依照迈尔·舍恩伯格及库克在《大数据时代》的描述,数据被定义为不用随机分析法(抽样调查)而运用所有数据的方法。除了对于社会组织、公共服务、人们生活的重大影响之外,这一热潮背后的关注焦点,其实还是商业模式,即相关数据仓库、数据安全、数据分析、数据挖掘等围绕大数据的商业价值利用。
大数据之所以在我国引起如此大的关注,也是由于在传统文化理念中,“大概齐、差不多”的习惯深入人心,在公共决策、商业选择、个人行为中充斥着“拍脑袋”现象。正如历史学家黄仁宇在《赫逊河畔谈中国历史》所论述的那样,“西欧和日本都已以商业组织的精神一切按实情主持国政的时候,中国仍然是亿万军民不能在数目字上管理。”当然,这种模糊管理下的信息不对称,亦成为另外一种既定利益格局的存在基础。正因为此,当信息爆炸时代快速来临之时,对数据信息的渴望迅速在社会不同层面体现出来。据报,汪洋副总理就曾向广东财政厅干部推荐涂子沛写的《大数据》。
要论大数据的历史,或可追溯到19世纪末。美国统计学家赫尔曼·霍尔瑞斯为统计1890年的人口普查数据,发明了一台电动器来读取卡片上的洞数,该设备用一年时间完成了原本需耗时八年的人口普查,由此开启了数据处理的新纪元。进入21世纪,随着信息技术、云计算的高速发展,以及社交网络的普及,大数据被赋予了全新含义。应该说,基于数据化严重不足的大背景,在我国经济社会发展中强调大数据的作用,其积极意义非常深远,但与此同时,也要避免走向另外的某些极端,这就需要相应的冷思考。
比如,在大数据的推动者之中,一方面各类新兴互联网企业成为主力,另一方面传统企业也在着力跟随,其根本动力都是在于发掘新的商业利润来源,以弥补我国经济转型期的投资迷茫。在此过程中,对于个人的利益和诉求还缺乏合理的认识和定位。虽然大数据对于进一步理解和服务消费者起到重要作用,但从其他侧面看,无序的、低效的、无用的信息轰炸,往往给个人带来“信息过度”的不佳体验,而在数据成为财富的狂热驱动下,对于个人信息权利的侵犯几乎无处不在,尤其在我国缺乏个人信息保护规则的条件下,数据渴望和采集很可能成为激怒消费者的动因,且拉大了与真正的消费者主权社会的距离。
另外,更值得我们思考的是,如果信息产生基础或其环境存在问题,那么大数据的技术是否会造成更大的信息扭曲?从金融市场的角度看,大数据在深刻改变高频交易方式、信贷风险判断等环节同时,也带来了其他潜在风险的积累,如信息误读造成的市场波动突然被放大,以及难以监管的新型金融产品创新等等。可以说,在诸多领域都缺乏法律游戏规则约束,更缺乏职业道德约束的情况下,如果初始数据就存在问题,那么在此基础上的大数据分析手段,恐怕就只有“南辕北辙”的效果了。从大处说,各类统计数据造假历年来都是被舆论广泛质疑的焦点;从小处说,在很多领域数据失真已经成为常态。例如,据5月7日的《北京青年报》报道,由于受到利益绑架,北京地区的电视收视率数据或许已被污染。再如,我国赴海外留学生的国内学校成绩,就一度存在许多造假行为,直到欧美出现更严厉的制约才有所收敛。无论如何,一旦数据本身的问题太多,则带来的只有大数据的灾难。
我们知道,信息不对称的后果是扭曲了市场机制的作用,误导了市场信息,造成市场失灵。如果处在普遍的信息数据缺乏状态下,经济行为的不确定性也会增加,往往会降低市场效率。反之,是过犹不及,即便是在上世纪末所谓“信息爆炸”年代,也远不如当前阶段如此快速的信息积累。据统计,互联网上的数据每两年翻一番,而全球绝大多数数据都是最近几年才产生的。面对似乎逐渐“供大于求”的数据,如何找到有用的信息,成为利用大数据的关键问题。正如美国颇有影响力的预测专家纳特·西尔弗在《信号与噪声》一书中所分析的:“如果信息的数量以每天250兆亿字节的速度增长,其中有用的信息肯定接近于零。大部分信息都只是噪声而已,而且噪声的增长速度要比信号快得多。”由此看来,当数据信息铺天盖地而来之时,也可能距离真相越来越远。在现实中,对于一哄而上追求大数据的企业来说,也需要冷静思考下,在信息过度充分的年代,如何把数据真正变成真正的价值?
大数据如同一把双刃剑,正如不少好莱坞电影中政府对公众无所不在的监控,大数据的爆炸,也让现代人对个人信息安全失控充满了担忧。斯诺登和棱镜事件,进一步在全球范围的国家之间提出这个疑问。一方面,在不可避免地拥抱大数据时代之前,可能更需要加强对其潜在风险的认识,做好基础数据净化、个人信息保护、国家信息安全等基础性建设;另一方面,大数据既可用来推动新商业模式演进,也可用来通过“抓坏蛋”,间接促进社会信息环境的完善,从而夯实大数据根基。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
尊敬的考生: 您好! 我们诚挚通知您,CDA Level III 考试大纲将于 2025 年 12 月 31 日实施重大更新,并正式启用,2026年3月考 ...
2025-12-31“字如其人”的传统认知,让不少“手残党”在需要签名的场景中倍感尴尬——商务签约时的签名歪歪扭扭,朋友聚会的签名墙不敢落笔 ...
2025-12-31在多元统计分析的因子分析中,“得分系数”是连接原始观测指标与潜在因子的关键纽带,其核心作用是将多个相关性较高的原始指标, ...
2025-12-31对CDA(Certified Data Analyst)数据分析师而言,高质量的数据是开展后续分析、挖掘业务价值的基础,而数据采集作为数据链路的 ...
2025-12-31在中介效应分析(或路径分析)中,间接效应是衡量“自变量通过中介变量影响因变量”这一间接路径强度与方向的核心指标。不同于直 ...
2025-12-30数据透视表是数据分析中高效汇总、多维度分析数据的核心工具,能快速将杂乱数据转化为结构化的汇总报表。在实际分析场景中,我们 ...
2025-12-30在金融投资、商业运营、用户增长等数据密集型领域,量化策略凭借“数据驱动、逻辑可验证、执行标准化”的优势,成为企业提升决策 ...
2025-12-30CDA(Certified Data Analyst),是在数字经济大背景和人工智能时代趋势下,源自中国,走向世界,面向全行业的专业技能认证,旨 ...
2025-12-29在数据分析领域,周期性是时间序列数据的重要特征之一——它指数据在一定时间间隔内重复出现的规律,广泛存在于经济、金融、气象 ...
2025-12-29数据分析师的核心价值在于将海量数据转化为可落地的商业洞察,而高效的工具则是实现这一价值的关键载体。从数据采集、清洗整理, ...
2025-12-29在金融、零售、互联网等数据密集型行业,量化策略已成为企业提升决策效率、挖掘商业价值的核心工具。CDA(Certified Data Analys ...
2025-12-29CDA中国官网是全国统一的数据分析师认证报名网站,由认证考试委员会与持证人会员、企业会员以及行业知名第三方机构共同合作,致 ...
2025-12-26在数字化转型浪潮下,审计行业正经历从“传统手工审计”向“大数据智能审计”的深刻变革。教育部发布的《大数据与审计专业教学标 ...
2025-12-26统计学作为数学的重要分支,是连接数据与决策的桥梁。随着数据规模的爆炸式增长和复杂问题的涌现,传统统计方法已难以应对高维、 ...
2025-12-26数字化浪潮席卷全球,数据已成为企业核心生产要素,“用数据说话、用数据决策”成为企业生存与发展的核心逻辑。在这一背景下,CD ...
2025-12-26箱线图(Box Plot)作为数据分布可视化的核心工具,凭借简洁的结构直观呈现数据的中位数、四分位数、异常值等关键信息,广泛应用 ...
2025-12-25在数据驱动决策的时代,基于历史数据进行精准预测已成为企业核心需求——无论是预测未来销售额、客户流失概率,还是产品需求趋势 ...
2025-12-25在数据驱动业务的实践中,CDA(Certified Data Analyst)数据分析师的核心工作,本质上是通过“指标”这一数据语言,解读业务现 ...
2025-12-25在金融行业的数字化转型进程中,SQL作为数据处理与分析的核心工具,贯穿于零售银行、证券交易、保险理赔、支付结算等全业务链条 ...
2025-12-24在数据分析领域,假设检验是验证“数据差异是否显著”的核心工具,而独立样本t检验与卡方检验则是其中最常用的两种方法。很多初 ...
2025-12-24