京公网安备 11010802034615号
经营许可证编号:京B2-20210330
朋友圈背后的大数据猜想_ 数据分析师
世界上最遥远的距离,是你看到宝马中国,我却只看到可口可乐。
宝马、Vivo智能手机、可口可乐三组广告在微信朋友圈上线,迅速引爆了一波网络热议。大家不再议论“朋友圈里该不该有广告”,转而一遍遍地问着:“为什么你看到了宝马,而我只看到可口可乐?”“我用的明明是iPhone6,为什么给我推送国产手机广告?你们真的有大数据吗?”
对此,腾讯官方给小编的解释是:“为保证注重用户体验和给用户带来的价值,朋友圈广告采用了更加智能的技术。所以不是所有好友都会看到同样的广告。”至于“更加智能的技术”是什么,腾讯没有给出答案。微信方面也表示,朋友圈广告目前仍处于内测阶段,坊间流传的各种所谓“投放标准”,都是猜测。
虽然只能靠猜,但咱也要猜得有点技术含量。@新闻小编请来了在互联网行业从业多年、担任数据分析研究员的网友@Kevin,从技术角度来分析和“猜测”一下朋友圈广告背后暗藏的大数据秘密。
为什么有人看到宝马,有人看到可口可乐?
网传说法
此次的微信广告推送是基于大数据分析后进行的精准营销,根据对用户收入和消费能力的分析来决定投放何种广告;腾讯人工智能对用户的识别分类如下:年收入100万元以上的用户收到的是宝马广告;买不起iPhone6但买得起小米的用户收到的是 Vivo广告;连红米都买不起的用户收到的是可口可乐的广告。
专家猜想
大数据是可以实现以收入和消费能力来对用户进行群分的。简单来说,首先对用户的性别、年龄、在朋友圈发布的图文信息、用户之间的聊天记录、关注和阅读的公众号文章类型等数据进行收集,使用适当的算法来分析这些数据,得到能够描绘用户群体特征的预测模型,然后根据预测模型里的特征对用户进行逐一预测,判断其是否可以进行广告投放,以及投放的广告类型。
当然,这只是理论上的可行性。实践中,是否能够得到基于收入和消费能力的用户人群分类,需要看收集到的数据是否对收入和消费能力有指示作用。如果一个人收入很高但他发布的朋友圈消息和聊天的内容只是与一些很廉价的商品有关,那是无论如何也不可能解读出他有高消费能力的。
小编推断
你虽然是宝马车主,但是从不在朋友圈“炫富”,反而经常夸赞国产手机好用,最爱在微信购物里面秒杀9.9元的特价商品……那么,你在微信的广告系统里,应该是不太可能被划分为“年收入100万元以上”的。据此猜想,其实是你自己没有告诉微信你“有钱”,那就不能怪人家不给你看宝马广告了。
为什么有人一直刷不到广告?
网传说法
因为穷得惊动了微信后台!那些喜欢在朋友圈吹水,特别闲的,但没有收到朋友圈广告的,微信是在告诉你,没钱就好好干活,别刷手机了。
官方说法
根据腾讯科技的报道,微信广告引擎会选出高品质的种子用户作为广告的第一批曝光对象,只要种子用户在该条广告下面评论或者点“赞”,就能提高他们的好友看到该条广告的几率。
专家猜想
基于朋友链条关系来进行广告的扩散,这个逻辑在理论上和实践上都是可行的,但是准确性不好估计。其实除了这个“扩散逻辑”之外,在用户分类的时候,其中或许就包括了“不投放”这一类,所以有些人看不到广告也是很正常的。
小编推断
如果你自始至终都没有看到过朋友圈广告,首先你肯定不是微信的“种子用户”;然后也许是因为你的好友中没有“种子用户”,或者他们看到了但没有对广告进行评论或点赞;也许你一开始就被划分到了“不投放”的类别。至于“不投放”的理由是不是因为你穷,这个就得问腾讯了。
屌丝刷到了宝马,
这真的是大数据精准投放吗?
网传说法
收到宝马广告的用户不一定能买得起宝马,而更有可能是那些喜欢炫耀与转发的人,通过不断转发,广告主投放的广告费用才会体现出更大的价值。
专家猜想
大数据也会出错。毕竟这是数据统计,只要是统计就会有错,小概率事件时有发生,错了也不奇怪。大数据统计的是显著性,这种显著性是由大多数人的共同行为确定的,因此统计模型倾向于选择那些对多数人正确、而对少数人可能不准确的分类结果。
也许不准确的概率是10%,但这并不代表不会发生。理论上说,如果确实是按照用户的收入和消费能力来进行三个广告的分类投放,那么“屌丝收到宝马广告”这种情况应该算在10%的概率内,并不能以此说明大数据不精准。
当然,如果网友们的说法属实,那么宝马广告的投放策略是从传播角度考虑,怎样才能最有效地将广告扩散出去,而不是为了找出真正的宝马车主和潜在车主。这,就不是技术范畴的问题了。
小编推断
理论告诉我们,大数据也是会出错的。你被错位投放了,这是小概率事件,在数以亿计的大数据面前,是被允许的。实践告诉我们,也许,错位投放才是真正的策略,因为微信之父张小龙最爱强调人性,“没收到广告的展示失落,收到广告的对比虚荣”,这就是人性。
小编点题
微信大数据不只是做广告这么简单
微博上发的牢骚,朋友圈晒的自拍,QQ上的个性签名,淘宝上的每一笔交易,以及近年来科技界最火爆的智能穿戴设备记录的衣食住行信息……你在网络上所有的碎片化信息,经过大数据收集、转化、提纯,最终都可以拼凑出一个活生生的你来。
采访中,Kevin告诉小编,数据的收集、分析、应用,与用户的隐私之间,一直存在着矛盾。要想尽可能有效地运用大数据来让生活变得更便捷,又不接触任何用户隐私,这几乎是不可能的事情。就拿大家平时都特爱的搜索美食一事来说,你想搜索附近哪里有好吃的餐厅,又不让搜索引擎获知你的位置信息,这就很难办了。
一个拥有数据强势的公司是强悍的,但希望这种强悍是以良善为基础和目标。我们乐于拥抱新技术,但也希望在交出个人隐私的同时,能得到最好的保护。从这几天的朋友圈广告中,我们能得到的,也许不只是如何做好营销这么简单。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python开发中,HTTP请求是与外部服务交互的核心场景——调用第三方API、对接微服务、爬取数据等都离不开它。虽然requests库已 ...
2025-12-12在数据驱动决策中,“数据波动大不大”是高频问题——零售店长关心日销售额是否稳定,工厂管理者关注产品尺寸偏差是否可控,基金 ...
2025-12-12在CDA(Certified Data Analyst)数据分析师的能力矩阵中,数据查询语言(SQL)是贯穿工作全流程的“核心工具”。无论是从数据库 ...
2025-12-12很多小伙伴都在问CDA考试的问题,以下是结合 2025 年最新政策与行业动态更新的 CDA 数据分析师认证考试 Q&A,覆盖考试内容、报考 ...
2025-12-11在Excel数据可视化中,柱形图因直观展示数据差异的优势被广泛使用,而背景色设置绝非简单的“换颜色”——合理的背景色能突出核 ...
2025-12-11在科研实验、商业分析或医学研究中,我们常需要判断“两组数据的差异是真实存在,还是偶然波动”——比如“新降压药的效果是否优 ...
2025-12-11在CDA(Certified Data Analyst)数据分析师的工作体系中,数据库就像“数据仓库的核心骨架”——所有业务数据的存储、组织与提 ...
2025-12-11在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01