
大数据真是“大”吗? 并不见得
数据并不只是因为成为了“大数据”才有了价值,“小数据”就没有价值吗?而是只要是数据都是有价值的。
大数据(bigdata),或称巨量资料,指的是所涉及的资料量规模巨大到无法通过目前主流软件工具,在合理时间内达到撷取、管理、处理、并整理成为帮助企业经营决策更积极目的的资讯(见百度百科)。业界将其归纳为4“V”—Volume(大量)、Velocity(高速)、Variety(多样)、Veracity(真实性)。大数据的“大”,目前应该是指与计算机为代表的信息设备诞生以来这70年所产生的信息数据相比是“大”了,即与历史产生的信息数据相比是“巨量”了。但若我们将其放在纵、横两个维度上去比,大数据还“大”吗?
从数据产生的过程看。目前的大数据(从TB级别,跃升到了PB级别)与以往的MB、GB级别相比确实大了,但与未来的EB、ZB级别相比还只能称之为“小数据”。从数据以外方面看。首先与同为IT概念的IP地址的IPv6相比,即使目前定义数据量最大计量单位DB,与其相比还差近2个级别。再与信息(在此信息即为数据,下同)共同构成世界的物质、能量三要素的其他二要素物质、能量相比,地球的质量约为5.98×1027克,世界探明煤炭资源可采储量约为9.84×1017克,10TB大约等于一个人脑的存储量,全球70亿人的脑存储量约为6.52×270Byte,相对应来看目前所说的大数据也并不“大”。但我们也还没有称IPv6为“大IP地址”,没有称物质、能量为“大物质”、“大能量”等等。
在物质世界有“大”就有“小”,如物质就计量单位从小到大有克、十克、百克、千克……,从大到小有克、分克、厘克、毫克……。而数据,目前计量单位只能从小到大有bit、Byte、KB、MB……,但却不能从大到小。而我们知道数据计量单位每缩小一个级别,则数据量就可增加1024即210倍。
物质有限可分还是无限可分虽然还将争论下去,但就当今理论和实践的发展看物质是可分的,就物质的计量单位而言是具有双向性的(能大能小)。而数据似乎是不可分的,就数据的计量单位而言似乎是单向性的(只能大)。
若将物质资源的计量单位定为“克”,则煤炭储量的数值可与数据资源数值的EB对应;而若将物质资源的计量单位定为“毫克”,则煤炭储量的数值就可与数据资源数值的ZB对应。就当今理论和实践的发展看物质是可分的,则物质资源的数值相较数据资源就计量单位而言似乎是无限大的,数据资源的“大”就更待商榷了。
人类利用物质和能量资源的过程是:自然产生物质和能量资源(软件),人类发明工具开发物质和能量资源(硬件),人类改进工艺利用物质和能量资源。即先有物质和能量资源,再有开发物质和能量资源的硬、软件工具。
而人类利用数据资源的过程是:人类发明了计算机等信息设备来承载数据资源(硬件),人类设计了软件来处理数据资源(软件),数据才向人类展现出其资源的特性(资源)。即先有了开发数据资源的硬、软件工具,再有数据资源。
物质和能量资源的产生经过了亿万年自然的进化,其产生与人类没有关系,即不已人类的意志而转移。而数据资源的产生只有短短的几十年时间(该数据资源是指计算机诞生以后产生的信息数据资源),其产生与人类有直接关系,即其会随着人类的意志而转移。这种根本性的不同,对人类意味着什么?目前我们不得而知。物质不灭定律(又称“质量守恒定律”)告诉我们“物质虽然能够变化,但不能消灭或凭空产生”。数据是否也是不灭的,数据又将如何变化呢?这些,我们都是无法回答的。
目前,“大数据”的核心只是改变了人类以前的理解,即承载数据的硬件有价值,处理数据的软件有价值,而数据本身却不具有价值。由此,呈现了数据本身也是具有价值这一理念。
“大数据”一词,目前还只是IT界自说自话的技术术语,并没有体现出其价值所在,百姓并不明白它有什么用处。其实还不如称“大数据”为“数据资源”或“资源数据”。以突出“资源”一词所蕴含的价值,以体现数据的资源特性。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
2025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-05-27CDA数据分析师证书考试体系(更新于2025年05月22日)
2025-05-26解码数据基因:从数字敏感度到逻辑思维 每当看到超市货架上商品的排列变化,你是否会联想到背后的销售数据波动?三年前在零售行 ...
2025-05-23在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27数据分析在当今信息时代发挥着重要作用。单因素方差分析(One-Way ANOVA)是一种关键的统计方法,用于比较三个或更多独立样本组 ...
2025-04-25