京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国式大数据都是忽悠人的?
大数据是仅次于互联网思维之外最热的词,大数据原来的意思是互联网或者移动互联网让人们收集数据变得更加方便,这种方便又可以直接转换为某种直观的相关把握,从而便于决策。
比如谷歌搜索里面趋势项目在印度应对疟疾的作用,谷歌比印度官方还更早地知道了疟疾扩散的路径和放大程度。还有一个著名的例子是百货公司的销售数据发现尿布和啤酒的相关关系,男人为自己的婴儿买尿布顺便会买几罐啤酒,那么正确的货品摆放是将尿布和啤酒放在一起,这样会提高销售额。
这些都是比较正面的例子,人们被这些例子所打动,觉得大数据真的很好很好,不需要深究因果,就可以做出正确的关联性判断,从而美化生活。
但是大数据在中国,尤其在中国最火爆的领域,比如手机、电商、娱乐等等诸多领域都变了味道,大数据变成了一种大造假,它的基本逻辑是,通过制造一个令人吃惊的数据,达到欺骗或者吆喝的目的,从而榨取整个社会残余的一点点信任。笔者觉得,中国大数据已经变成了互联网思维骗术的最核心部分。
举几个例子吧。比如一家著名的智能手机生产商,它们基本都是采取电商模式,不走任何线下渠道或者定制机,他们最常见的举动就是在双11或者自己的某某节上宣布,几秒之内就销售了多少部手机,一天之内就是百万部,它的手机永远都是秒内售磬,弄得没买到的人都不知道时间去了哪儿?
在苹果iPhone最热的时候,这家手机公司也跟苹果一样,采取粉丝大清早起来就排队的模式,弄得争议很大,因为买iPhone在美国也排队在欧洲也排队在亚洲也排队,几乎变成了一种全球化现象,大家都觉得这是真的。而这家手机商在中国玩雇佣排队,就令人感到很奇怪,所以有争议。这家不断进步的手机商也很聪明,随后将精力主要放在线上,开启了线上秒杀模型。
线上有几个特点,第一是节省店面成本;第二是收集需求,有需求才发货,这端不动那端也不动,很互联网思维。第三点没有人说,可以造交易量的假。比如发售手机100万部,预估兴奋的屌丝大约30万,那么70万部就可以自己买,通过账户打钱来买,因为买的是自己的东西,钱落入的账户也是自己的账户,在德隆时代的股票市场,这叫自买自卖自弹自唱。弄得很热火,也吸收小散进去看看。
当然,卖手机比弄股票还是厚道一些,无非是让潜在好奇的人也进去看看,觉得不错买一部,不至于套牢这么严重,况且人家手机的确很便宜。但这其中的内在道理是一样的,线上交易无论是天猫还是自己的电商平台,都是可以“造大数据”的。
业内基本都领会了这三点做法,笔者看到其他的一些国产手机商都开始学习这套模式,笔者有100%信心展望:未来各手机商宣布卖出的手机量之和肯定高于整体手机出货量,就像中国的GDP统计一样,各省统计出来的GDP之和,远远统计局做的总量抽样估计,这种宏观上的中国式统计景观,已经大面积地出现在微观企业的互联网思维中。
中国式大数据的核心关键词,除了展示自己的东西如何牛之外,主要是通过数据来影响消费者,达到数据操控和数据干扰的目的。
再简单举个例子,现在很多做电影电视或者做书的,都喜欢做一个预定的app,意思是如果观众读者先预定了电影票或者期书,那么到了真实购买阶段,是有很大的折扣的。但一般来说,他们都会将观众或者读者的数量弄得很高,制造出很红火的样子,他们的目的不是为了收集未来需求,而是要影响院线或者出版社:你看,观众和读者这么踊跃,意味着该片或者该书是非常牛的,你们院线或者出版社要拿出最好的放映资源或者出版推广资源来做——“大数据”变成了一种影响力或者操纵力。
在一些更草根的领域里面,大数据黑幕更是泛滥。现在最草根最惊愕的领域是自媒体融资领域,动不动一个小公号就宣布自己融资百万或者千万,估值上亿。当然,不否认这个世界的确存在很多傻钱,有些媒体人的资源的确还不错,融点小钱也不在话下,但是傻钱也不是你们想得那样。比如笔者亲自看到的案例是这样的:一个信息类的app项目估值,融资方的确给了点小钱,不到100万,但被吆喝成2千万,只占20%的股份,这意味着该项目估值已经达到了亿级,融资方是这么告诉该项目的创始人,100万省点花,够你们这点人干一年,你们要努力干,等未来市场更热一点,找一个更傻的人做B轮融资,就算成本价,也能算上1亿,大家都赚了。所以,现在这个估值钱可以少点,但口气绝不能小点。未来的盈利模式是有可能做大,但主要精力用于博傻。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28SQL是数据分析领域最基础、最核心的工具,承担着取数、清洗、统计、分层、归因的全流程工作。不同于单纯的语法练习,实战化SQL数 ...
2026-08-28 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-08-28随着新零售模式的快速普及,零售行业从传统的“货品驱动”全面转向“用户驱动”。门店交易数据、线上消费记录、浏览轨迹、复购频 ...
2026-08-27在数据分析、爬虫采集、接口开发、数据归档等场景中,JSON与CSV是两种使用率最高的数据存储格式。JSON为键值对结构化格式,适配 ...
2026-08-27 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-08-27在数据分析工作中,时间序列是最常见的数据类型之一,订单时间、日志时间、交易时段、统计周期等数据均离不开时间处理。原始数据 ...
2026-08-26在数据分析与数据预处理工作中,原始数据普遍存在录入错误、系统故障、偶然极值等问题,极易产生异常数据。异常数据会严重干扰数 ...
2026-08-26 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-08-26在数理统计与数据分析领域,多因素方差分析与线性回归模型是研究变量关系、因素影响、数据差异规律的两大核心工具。二者均属于经 ...
2026-08-25数据分析的核心价值不在于数据计算与图表制作,而在于清晰、精准、有逻辑地输出结论、支撑业务决策。日常数据分析报告普遍存在结 ...
2026-08-25 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-08-25平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24