
从另一个视角看大数据
大数据之所以在我国引起如此大的关注,也是由于在传统文化理念中,“大概齐、差不多”的习惯深入人心,在公共决策、商业选择、个人行为中充斥着“拍脑袋”现象。
大数据是当下最时髦的话题之一,依照迈尔·舍恩伯格及库克在《大数据时代》的描述,数据被定义为不用随机分析法(抽样调查)而运用所有数据的方法。除了对于社会组织、公共服务、人们生活的重大影响之外,这一热潮背后的关注焦点,其实还是商业模式,即相关数据仓库、数据安全、数据分析、数据挖掘等围绕大数据的商业价值利用。
大数据之所以在我国引起如此大的关注,也是由于在传统文化理念中,“大概齐、差不多”的习惯深入人心,在公共决策、商业选择、个人行为中充斥着“拍脑袋”现象。正如历史学家黄仁宇在《赫逊河畔谈中国历史》所论述的那样,“西欧和日本都已以商业组织的精神一切按实情主持国政的时候,中国仍然是亿万军民不能在数目字上管理。”当然,这种模糊管理下的信息不对称,亦成为另外一种既定利益格局的存在基础。正因为此,当信息爆炸时代快速来临之时,对数据信息的渴望迅速在社会不同层面体现出来。据报,汪洋副总理就曾向广东财政厅干部推荐涂子沛写的《大数据》。
要论大数据的历史,或可追溯到19世纪末。美国统计学家赫尔曼·霍尔瑞斯为统计1890年的人口普查数据,发明了一台电动器来读取卡片上的洞数,该设备用一年时间完成了原本需耗时八年的人口普查,由此开启了数据处理的新纪元。进入21世纪,随着信息技术、云计算的高速发展,以及社交网络的普及,大数据被赋予了全新含义。应该说,基于数据化严重不足的大背景,在我国经济社会发展中强调大数据的作用,其积极意义非常深远,但与此同时,也要避免走向另外的某些极端,这就需要相应的冷思考。
比如,在大数据的推动者之中,一方面各类新兴互联网企业成为主力,另一方面传统企业也在着力跟随,其根本动力都是在于发掘新的商业利润来源,以弥补我国经济转型期的投资迷茫。在此过程中,对于个人的利益和诉求还缺乏合理的认识和定位。虽然大数据对于进一步理解和服务消费者起到重要作用,但从其他侧面看,无序的、低效的、无用的信息轰炸,往往给个人带来“信息过度”的不佳体验,而在数据成为财富的狂热驱动下,对于个人信息权利的侵犯几乎无处不在,尤其在我国缺乏个人信息保护规则的条件下,数据渴望和采集很可能成为激怒消费者的动因,且拉大了与真正的消费者主权社会的距离。
另外,更值得我们思考的是,如果信息产生基础或其环境存在问题,那么大数据的技术是否会造成更大的信息扭曲?从金融市场的角度看,大数据在深刻改变高频交易方式、信贷风险判断等环节同时,也带来了其他潜在风险的积累,如信息误读造成的市场波动突然被放大,以及难以监管的新型金融产品创新等等。可以说,在诸多领域都缺乏法律游戏规则约束,更缺乏职业道德约束的情况下,如果初始数据就存在问题,那么在此基础上的大数据分析手段,恐怕就只有“南辕北辙”的效果了。从大处说,各类统计数据造假历年来都是被舆论广泛质疑的焦点;从小处说,在很多领域数据失真已经成为常态。例如,据5月7日的《北京青年报》报道,由于受到利益绑架,北京地区的电视收视率数据或许已被污染。再如,我国赴海外留学生的国内学校成绩,就一度存在许多造假行为,直到欧美出现更严厉的制约才有所收敛。无论如何,一旦数据本身的问题太多,则带来的只有大数据的灾难。
我们知道,信息不对称的后果是扭曲了市场机制的作用,误导了市场信息,造成市场失灵。如果处在普遍的信息数据缺乏状态下,经济行为的不确定性也会增加,往往会降低市场效率。反之,是过犹不及,即便是在上世纪末所谓“信息爆炸”年代,也远不如当前阶段如此快速的信息积累。据统计,互联网上的数据每两年翻一番,而全球绝大多数数据都是最近几年才产生的。面对似乎逐渐“供大于求”的数据,如何找到有用的信息,成为利用大数据的关键问题。正如美国颇有影响力的预测专家纳特·西尔弗在《信号与噪声》一书中所分析的:“如果信息的数量以每天250兆亿字节的速度增长,其中有用的信息肯定接近于零。大部分信息都只是噪声而已,而且噪声的增长速度要比信号快得多。”由此看来,当数据信息铺天盖地而来之时,也可能距离真相越来越远。在现实中,对于一哄而上追求大数据的企业来说,也需要冷静思考下,在信息过度充分的年代,如何把数据真正变成真正的价值?
大数据如同一把双刃剑,正如不少好莱坞电影中政府对公众无所不在的监控,大数据的爆炸,也让现代人对个人信息安全失控充满了担忧。斯诺登和棱镜事件,进一步在全球范围的国家之间提出这个疑问。一方面,在不可避免地拥抱大数据时代之前,可能更需要加强对其潜在风险的认识,做好基础数据净化、个人信息保护、国家信息安全等基础性建设;另一方面,大数据既可用来推动新商业模式演进,也可用来通过“抓坏蛋”,间接促进社会信息环境的完善,从而夯实大数据根基。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
LSTM 输出不确定的成因、影响与应对策略 长短期记忆网络(LSTM)作为循环神经网络(RNN)的一种变体,凭借独特的门控机制,在 ...
2025-07-07统计学方法在市场调研数据中的深度应用 市场调研是企业洞察市场动态、了解消费者需求的重要途径,而统计学方法则是市场调研数 ...
2025-07-07CDA数据分析师证书考试全攻略 在数字化浪潮席卷全球的当下,数据已成为企业决策、行业发展的核心驱动力,数据分析师也因此成为 ...
2025-07-07剖析 CDA 数据分析师考试题型:解锁高效备考与答题策略 CDA(Certified Data Analyst)数据分析师考试作为衡量数据专业能力的 ...
2025-07-04SQL Server 字符串截取转日期:解锁数据处理的关键技能 在数据处理与分析工作中,数据格式的规范性是保证后续分析准确性的基础 ...
2025-07-04CDA 数据分析师视角:从数据迷雾中探寻商业真相 在数字化浪潮席卷全球的今天,数据已成为企业决策的核心驱动力,CDA(Certifie ...
2025-07-04CDA 数据分析师:开启数据职业发展新征程 在数据成为核心生产要素的今天,数据分析师的职业价值愈发凸显。CDA(Certified D ...
2025-07-03从招聘要求看数据分析师的能力素养与职业发展 在数字化浪潮席卷全球的当下,数据已成为企业的核心资产,数据分析师岗位也随 ...
2025-07-03Power BI 中如何控制过滤器选择项目数并在超限时报错 引言 在使用 Power BI 进行数据可视化和分析的过程中,对过滤器的有 ...
2025-07-03把握 CDA 考试时间,开启数据分析职业之路 在数字化转型的时代浪潮下,数据已成为企业决策的核心驱动力。CDA(Certified Da ...
2025-07-02CDA 证书:银行招聘中的 “黄金通行证” 在金融科技飞速发展的当下,银行正加速向数字化、智能化转型,海量数据成为银行精准 ...
2025-07-02探索最优回归方程:数据背后的精准预测密码 在数据分析和统计学的广阔领域中,回归分析是揭示变量之间关系的重要工具,而回 ...
2025-07-02CDA 数据分析师报考条件全解析:开启数据洞察之旅 在当今数字化浪潮席卷全球的时代,数据已成为企业乃至整个社会发展的核心驱 ...
2025-07-01深入解析 SQL 中 CASE 语句条件的执行顺序 在 SQL 编程领域,CASE语句是实现条件逻辑判断、数据转换与分类的重要工 ...
2025-07-01SPSS 中计算三个变量交集的详细指南 在数据分析领域,挖掘变量之间的潜在关系是获取有价值信息的关键步骤。当我们需要探究 ...
2025-07-01CDA 数据分析师:就业前景广阔的新兴职业 在当今数字化时代,数据已成为企业和组织决策的重要依据。数据分析师作为负责收集 ...
2025-06-30探秘卷积层:为何一个卷积层需要两个卷积核 在深度学习的世界里,卷积神经网络(CNN)凭借其强大的特征提取能力 ...
2025-06-30探索 CDA 数据分析师在线课程:开启数据洞察之旅 在数字化浪潮席卷全球的当下,数据已成为企业决策、创新与发展的核心驱 ...
2025-06-303D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32% 编辑:LRST 【新智元导读】中科院自动化所提出BridgeVLA模型,通过将 ...
2025-06-30LSTM 为何会产生误差?深入剖析其背后的原因 在深度学习领域,LSTM(Long Short-Term Memory)网络凭借其独特的记忆单元设 ...
2025-06-27