对于大数据,这些认识上的bug你必须要知道
虽然大数据的发展(包括新型的非结构化数据和数据分析工具)正影响着各行各业,但关于大数据也有一些误解。
误解一:算法能解决一切问题请输入标题
我把这个误解称为神奇的算法。有关大数据的早期报道造成了一种假象:要想打造智能城市和企业,只要将功能最强大的电脑凑在一起,让它们去分析手头上的非结构化数据,找出规律,其中的商业洞见自然会浮现出来。但事实上,数据分析并不是这样完成的。
除了机器的运算,要使大数据发生效用还需要许多人力专家的参与,这是因为:数据的质量和准确性相当重要。数据是怎样收集的?误差率如何?样本是否有代表性?如果进行比对,不同的数据库中数据格式是否相同?因此,数据处理中的许多工作还需要人工操作,其中的尺度计算机很难拿捏。
受编程人员的主观影响,数据分析的算法也会出现各种偏差。比如,某个程序可以帮助企业筛选出最佳应聘者的简历,但是基于过去招聘经历的筛选结果并不一定能满足公司未来所需要的技能。
更重要的是,管理者需要提出关于数据的对的问题。公司现阶段最关心的结果是什么?数据呈现的哪些模式可以直接为公司所用?算法在寻找答案方面越来越游刃有余,但关键还要知道寻找什么问题的答案,这需要人来提出恰当的问题。凯撒娱乐的首席商务官塔里克·肖卡特曾这样说:“如果仅关注数据,那你可能将一无所获。我总是提醒我的团队去思考,你想要回答什么问题。”
误解二:相关分析至上
发现一种模式往往是不够的。许多评论家一再指出,有了大数据,数据科学再也不需要考虑因果关系,只关注相关关系即可。这种观点的潜在逻辑在于,通过大数据分析得到的规律近乎事实,无须再依赖人们所认知的因果判断。
显然这种观点是不可取的。管理者需要分清简单的相关分析和因果分析之间的差异,以及这种差异什么时候重要,什么时候不重要,这一点非常关键。简而言之,如果仅仅是为了做预测,看数据之间的相关关系便已足够;但如果你想改变前提条件,就必须考虑因果关系。
回到斯特林格的例子——就是发现降低城市树木修剪预算会引发诉讼数量增加的那个检察官。如果树木修剪预算不是引发诉讼数量变化的真正原因,那么提高树木修剪预算的方案就不会奏效。在这个例子里,搞清因果关系是很重要的。
还有一个例子,试想你的广告策划团队发现,俄亥俄州的已婚女性对你们的头发护理产品广告更感兴趣,但是你显然不能通过鼓励俄亥俄州的女性结婚来增加产品销量(这将影响前提条件)。相反,发现这一规律后,你可能会考虑将产品定位于俄亥俄州的已婚女性群体。在这种情形下,仅需要知道相关关系就可以了。
误解三:大数据是万金油
有时候人们将大数据与数据战略混为一谈。在很多情况下,企业完全可以建立宝贵的数据库,将之应用到战略中,而不一定非要使用大数据。
数据并不一定非要“大”(非结构化)才有用。从结构化的数据中(如顾客的点击行为——顾客一般会点击网页的什么位置、什么时候下拉屏幕、停留了多长时间、是否将商品放入购物车等)照样可以得到许多有价值的信息。即使在像脸书这样为许多世界大型服务器集群提供大数据的企业,其工程师每天处理的大多数问题也可以在一台运转良好的电脑上完成。数据战略的关键在于为企业提供价值,有时候需要大数据,有时候并不需要。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析在当今信息时代发挥着重要作用。单因素方差分析(One-Way ANOVA)是一种关键的统计方法,用于比较三个或更多独立样本组 ...
2025-04-25CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-25在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-24以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《刘静:10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda ...
2025-04-23大咖简介: 刘凯,CDA大咖汇特邀讲师,DAMA中国分会理事,香港金管局特聘数据管理专家,拥有丰富的行业经验。本文将从数据要素 ...
2025-04-22CDA持证人简介 刘伟,美国 NAU 大学计算机信息技术硕士, CDA数据分析师三级持证人,现任职于江苏宝应农商银行数据治理岗。 学 ...
2025-04-21持证人简介:贺渲雯 ,CDA 数据分析师一级持证人,互联网行业数据分析师 今天我将为大家带来一个关于用户私域用户质量数据分析 ...
2025-04-18一、CDA持证人介绍 在数字化浪潮席卷商业领域的当下,数据分析已成为企业发展的关键驱动力。为助力大家深入了解数据分析在电商行 ...
2025-04-17CDA持证人简介:居瑜 ,CDA一级持证人,国企财务经理,13年财务管理运营经验,在数据分析实践方面积累了丰富的行业经验。 一、 ...
2025-04-16持证人简介: CDA持证人刘凌峰,CDA L1持证人,微软认证讲师(MCT)金山办公最有价值专家(KVP),工信部高级项目管理师,拥有 ...
2025-04-15持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。在实际生活中,我们可能会 ...
2025-04-14在 Python 编程学习与实践中,Anaconda 是一款极为重要的工具。它作为一个开源的 Python 发行版本,集成了众多常用的科学计算库 ...
2025-04-14随着大数据时代的深入发展,数据运营成为企业不可或缺的岗位之一。这个职位的核心是通过收集、整理和分析数据,帮助企业做出科 ...
2025-04-11持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。 本次分享我将以教培行业为 ...
2025-04-11近日《2025中国城市长租市场发展蓝皮书》(下称《蓝皮书》)正式发布。《蓝皮书》指出,当前我国城市住房正经历从“增量扩张”向 ...
2025-04-10在数字化时代的浪潮中,数据已经成为企业决策和运营的核心。每一位客户,每一次交易,都承载着丰富的信息和价值。 如何在海量客 ...
2025-04-09数据是数字化的基础。随着工业4.0的推进,企业生产运作过程中的在线数据变得更加丰富;而互联网、新零售等C端应用的丰富多彩,产 ...
2025-04-094月7日,美国关税政策对全球金融市场的冲击仍在肆虐,周一亚市早盘,美股股指、原油期货、加密货币、贵金属等资产齐齐重挫,市场 ...
2025-04-08背景 3月26日,科技圈迎来一则重磅消息,苹果公司宣布向浙江大学捐赠 3000 万元人民币,用于支持编程教育。 这一举措并非偶然, ...
2025-04-07在当今数据驱动的时代,数据分析能力备受青睐,数据分析能力频繁出现在岗位需求的描述中,不分岗位的任职要求中,会特意标出“熟 ...
2025-04-03