京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国式大数据都是忽悠人的?
大数据是仅次于互联网思维之外最热的词,大数据原来的意思是互联网或者移动互联网让人们收集数据变得更加方便,这种方便又可以直接转换为某种直观的相关把握,从而便于决策。
比如谷歌搜索里面趋势项目在印度应对疟疾的作用,谷歌比印度官方还更早地知道了疟疾扩散的路径和放大程度。还有一个著名的例子是百货公司的销售数据发现尿布和啤酒的相关关系,男人为自己的婴儿买尿布顺便会买几罐啤酒,那么正确的货品摆放是将尿布和啤酒放在一起,这样会提高销售额。
这些都是比较正面的例子,人们被这些例子所打动,觉得大数据真的很好很好,不需要深究因果,就可以做出正确的关联性判断,从而美化生活。
但是大数据在中国,尤其在中国最火爆的领域,比如手机、电商、娱乐等等诸多领域都变了味道,大数据变成了一种大造假,它的基本逻辑是,通过制造一个令人吃惊的数据,达到欺骗或者吆喝的目的,从而榨取整个社会残余的一点点信任。笔者觉得,中国大数据已经变成了互联网思维骗术的最核心部分。
举几个例子吧。比如一家著名的智能手机生产商,它们基本都是采取电商模式,不走任何线下渠道或者定制机,他们最常见的举动就是在双11或者自己的某某节上宣布,几秒之内就销售了多少部手机,一天之内就是百万部,它的手机永远都是秒内售磬,弄得没买到的人都不知道时间去了哪儿?
在苹果iPhone最热的时候,这家手机公司也跟苹果一样,采取粉丝大清早起来就排队的模式,弄得争议很大,因为买iPhone在美国也排队在欧洲也排队在亚洲也排队,几乎变成了一种全球化现象,大家都觉得这是真的。而这家手机商在中国玩雇佣排队,就令人感到很奇怪,所以有争议。这家不断进步的手机商也很聪明,随后将精力主要放在线上,开启了线上秒杀模型。
线上有几个特点,第一是节省店面成本;第二是收集需求,有需求才发货,这端不动那端也不动,很互联网思维。第三点没有人说,可以造交易量的假。比如发售手机100万部,预估兴奋的屌丝大约30万,那么70万部就可以自己买,通过账户打钱来买,因为买的是自己的东西,钱落入的账户也是自己的账户,在德隆时代的股票市场,这叫自买自卖自弹自唱。弄得很热火,也吸收小散进去看看。
当然,卖手机比弄股票还是厚道一些,无非是让潜在好奇的人也进去看看,觉得不错买一部,不至于套牢这么严重,况且人家手机的确很便宜。但这其中的内在道理是一样的,线上交易无论是天猫还是自己的电商平台,都是可以“造大数据”的。
业内基本都领会了这三点做法,笔者看到其他的一些国产手机商都开始学习这套模式,笔者有100%信心展望:未来各手机商宣布卖出的手机量之和肯定高于整体手机出货量,就像中国的GDP统计一样,各省统计出来的GDP之和,远远统计局做的总量抽样估计,这种宏观上的中国式统计景观,已经大面积地出现在微观企业的互联网思维中。
中国式大数据的核心关键词,除了展示自己的东西如何牛之外,主要是通过数据来影响消费者,达到数据操控和数据干扰的目的。
再简单举个例子,现在很多做电影电视或者做书的,都喜欢做一个预定的app,意思是如果观众读者先预定了电影票或者期书,那么到了真实购买阶段,是有很大的折扣的。但一般来说,他们都会将观众或者读者的数量弄得很高,制造出很红火的样子,他们的目的不是为了收集未来需求,而是要影响院线或者出版社:你看,观众和读者这么踊跃,意味着该片或者该书是非常牛的,你们院线或者出版社要拿出最好的放映资源或者出版推广资源来做——“大数据”变成了一种影响力或者操纵力。
在一些更草根的领域里面,大数据黑幕更是泛滥。现在最草根最惊愕的领域是自媒体融资领域,动不动一个小公号就宣布自己融资百万或者千万,估值上亿。当然,不否认这个世界的确存在很多傻钱,有些媒体人的资源的确还不错,融点小钱也不在话下,但是傻钱也不是你们想得那样。比如笔者亲自看到的案例是这样的:一个信息类的app项目估值,融资方的确给了点小钱,不到100万,但被吆喝成2千万,只占20%的股份,这意味着该项目估值已经达到了亿级,融资方是这么告诉该项目的创始人,100万省点花,够你们这点人干一年,你们要努力干,等未来市场更热一点,找一个更傻的人做B轮融资,就算成本价,也能算上1亿,大家都赚了。所以,现在这个估值钱可以少点,但口气绝不能小点。未来的盈利模式是有可能做大,但主要精力用于博傻。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16在机器学习建模实践中,特征工程是决定模型性能的核心环节之一。面对高维数据集,冗余特征、无关特征不仅会增加模型训练成本、延 ...
2026-04-16在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09