京公网安备 11010802034615号
经营许可证编号:京B2-20210330
QQ大数据:年轻人逃离北上广了吗_数据分析师
早在2000年,诺贝尔经济学奖得主斯蒂格里茨就说过:21世纪影响人类进程有两件大事,一是以美国为首的新技术革命;一是中国的城市化。
当下中国已经有一个基本共识,就是没有城市化就没有中国的现代化。但是,出于精英阶层对大城市化和所谓“城市病”的恐惧;出于文人思维中区域均衡发展的乌托邦梦想;出于权力的傲慢与自负,当代中国的城市化进程一直存在着规律与规划撕裂、人口流动与政府导向背离等现象。它一方面导致人口净流出地区的过度投资和过度城市化,造成各种资源的巨大浪费。不把钱当钱,一直在搞小城镇大跃进,西部大开发,就地城镇化。另一方面导致人口净流入地区,尤其是流入大城市人口的各项基本自由和权利得不到保障,不把人当人,无视人的自由选择和自由迁徙权利,大城市想尽一切办法通过收容遣送(已废除)、户籍管制、学籍限制、产业强迁等往外“赶人”。
但事实证明以西部大开发和小城镇战略为代表的“区域均衡发展战略”是失败的。在产出和投入比中,东部一直最高,中部其次,西部和东北一直垫底;在经济发展上,西部与东部的差距越来越大。西部人口也持续外流。从国家统计局提供的数据看,在2001至2012年的11年中,河南、四川、安徽、贵州、广西等五个中西部省份出现了人口净减少。
而日前QQ基于8亿多活跃用户,通过大数据分析首次披露“逃离北上广”数据图。数据显示,2014年1月16日至2月1日,共计4907万人从北上广深四城回到全国各地,占四地总用户数的51%。节后,约1070万的人真正逃离了北上广深,逃离率为11%,其中,北京又以18%的逃离率成为人们最想逃离的城市。其余的人选择继续他们的打拼之路,再次离开亲人,义无反顾踏上回归北上广之路。
从2014年2月2日至2月25日,1994万用户在2014年首次从全国各地来到北上广深,新增率达到21%。其中近7成是18至29岁的年轻人,而北京凭借27%的涌入率,再次夺冠,成为人们最愿意来此打拼的城市。
解读规律探索规律坚守规律这样的知识求索,比解读政府工作报告往往更有意思也更有用,更能知道社会发展的潮流和方向。大数据是全数据,不带有任何取样的倾向性,也减少了取样的局限性。样本越大,真实准确率越高。有人提出,以QQ登录地作为统计根据,统计比例不会太科学,尤其是逃离部分,竞争力下降的中年以上农民工未必上QQ,这部分人处于自然规律和制造业萧条考量,应该才是逃离的主力,而新增部分应该是可信的,年轻人几乎很少不用QQ的。
这个分析有道理。也就是说,真正逃离北上广深的实际上不止11%,而“逃往”北上广深的21%,则比较接近真实数据。
但考虑到有关部门公布的2013年年末北京常住人口2114.8万;上海市常住人口2415.15万。广州估计1300万,深圳估计1100万左右,合计6930万,比QQ在这四城市的登录用户总数(4907÷51%=9621)还少2691万,当然这也许可以解释为多出部分为瞬间流动人口。再考虑到相当比例中年以上的农民工和中老年人不上QQ(这个比例也是确定的,就是QQ有8亿多活跃用户,全国13.7亿人,活跃用户与非活跃用户之比为8:5.7),因此我们可以推算,2013年底,北上广深四地活跃用户与非活跃用户分别为9621万和6855万。那么,包含瞬间流动人口在内,北上广深四城市2013年底的实际人口数量并非官方公布的6930万,而是高达1亿6476万。
考虑到北上广深的城市特征和年龄结构偏年轻的特征,而其余大量待在农村的人口不用QQ等,上述人口总数可以作适当修正,那么我们可以估计这四大城市的实际人口当也在1亿2000万上下,比官方公布的数据多出近一倍。
这个数据,可以从实际生活中得到验证。2013年某日在一个饭局上,某位从小和大大在一个大院里长大、其母亲对大大兄弟们还多有照顾的、对公共事务几乎不食人间烟火的生意人说,北京公安的朋友告诉他,北京的人口(含瞬间流动人口)实际上已经超过4千万。
为什么实际人口4千万,但官方数据只有2100多万?瞬间流动人口没有计入只是一部分原因(因为不可能那么多),还有一部分原因我猜是因为官方的主流意识形态一直在以资源有限理论控制大城市人口,实际人口与他们想控制的人口规模差别太大,将会揭示资源有限理论和人口控制理论的谎言破产。这个理论一破产,再提控制大城市人口就没有依据了,而且因为日积月累积重难返,他们将面临如何解决流动儿童就学、高考等巨大现实压力。
我们再来看“逃往”北上广深的人群。QQ大数据显示,1994万用户年后首次从全国各地来到北上广深四地。请注意,这里不含刚毕业的700多万大学生(学生6、7月才离校),大学生留在这四地的比例达到一半以上。智联招聘根据简历库数据分析显示,高校毕业生初次就业集中在北京、上海、广州、深圳四大城市的比例高达54.1%,毕业三年后在这四大城市就业的更是高达57.3%。
也就是说,每年北上广深四大城市新增就业人口将达到1994+350=2344万,而流出人口则近半。这2344万是个什么概念?国家统计局数据显示,2002年至2011年,中国城镇化率以平均每年1.35个百分点的速度发展,城镇人口平均每年增长2096万人。(2012年8月17日中国新闻网)也就是说,每年新进入北上广深四大城市的人口总量超过每年从农村进入城市的人口总量。
这样一分析,中国的城市化路径就变得很清晰了:中国的城市化过程,不仅是农村包围城市、农民成为市民的过程,而且是从小城市到大城市的过程。相当多人,包括大学毕业生,包括刚洗脚离田的青年农民,都是一步到位先进入大城市,然后其中一半左右的人,在经过大城市多年的熬煎与洗礼之后,因为种种原因再向中小城市分散。而大部分的人,则留在了大城市!QQ大数据表明,节后未返回北上广深的人群,大部分流向了山东、河南、湖南、安徽以及除广州深圳外的广东其他地区,在家乡附近的二三线城市找到了他们新的天地。
这一切说明了什么?说明市场规律不听领导和决策的指挥棒,反过来则说明决策不尊重公民自由、不尊重市场规律。如今我们三四线以下城市大跃进已经制造了大量空城,留下了巨额债务,给未来中国经济社会留下巨大隐患,但我们仍然在意气风发地“深入实施区域发展总体战略,优先推进西部大开发,全面振兴东北地区等老工业基地……”(《2014年政府工作报告》)我们仍然在以大无畏的精神说:“北京人口调控的当务之急是要痛下决心,坚决遏制住人口无序过快增长的势头,要抓好以业控人,坚决淘汰吸引流动人口过多的产业。”
城市化是经济自由和个人自由的必然结果,大城市化是资源节约、效率提高、人类自由与能量充分施展的必然要求和必然结果,也是浩浩荡荡势不可挡的全球性规律,顺之者繁荣昌盛,逆之者萧条衰败。任何把城市化当成经济增长、“城乡均衡发展”和“疏散大城市人口”的目的,最后都一定会遭遇失败的命运。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在统计学分析、实验研究、业务数据复盘过程中,单因素方差分析是检验自变量对因变量是否存在显著影响的核心方法。其中,两个水平 ...
2026-05-26【核心关键词】算法、客户、大数据、互联网、调优、建模、模型优化、机器学习、评分卡模型、模型开发、智能风控、业务场景、数 ...
2026-05-26 很多数据分析师写过无数个 SELECT,但当被问到“新建一张表,该如何定义字段类型来保证数据质量”“创建视图和存储物理表有 ...
2026-05-26在数据清洗、统计分析与数据质量检测工作中,箱型图(又称箱线图、Box Plot)是最直观、最高效的可视化分析工具之一。相较于柱状 ...
2026-05-25在大数据分析、数据清洗、质量管控、风险监测等领域,异常数据识别是保障数据质量、确保分析结论精准、规避业务决策失误的核心基 ...
2026-05-25 很多数据分析师精通Excel函数和透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么关系 ...
2026-05-25数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18