
QQ大数据:年轻人逃离北上广了吗_数据分析师
早在2000年,诺贝尔经济学奖得主斯蒂格里茨就说过:21世纪影响人类进程有两件大事,一是以美国为首的新技术革命;一是中国的城市化。
当下中国已经有一个基本共识,就是没有城市化就没有中国的现代化。但是,出于精英阶层对大城市化和所谓“城市病”的恐惧;出于文人思维中区域均衡发展的乌托邦梦想;出于权力的傲慢与自负,当代中国的城市化进程一直存在着规律与规划撕裂、人口流动与政府导向背离等现象。它一方面导致人口净流出地区的过度投资和过度城市化,造成各种资源的巨大浪费。不把钱当钱,一直在搞小城镇大跃进,西部大开发,就地城镇化。另一方面导致人口净流入地区,尤其是流入大城市人口的各项基本自由和权利得不到保障,不把人当人,无视人的自由选择和自由迁徙权利,大城市想尽一切办法通过收容遣送(已废除)、户籍管制、学籍限制、产业强迁等往外“赶人”。
但事实证明以西部大开发和小城镇战略为代表的“区域均衡发展战略”是失败的。在产出和投入比中,东部一直最高,中部其次,西部和东北一直垫底;在经济发展上,西部与东部的差距越来越大。西部人口也持续外流。从国家统计局提供的数据看,在2001至2012年的11年中,河南、四川、安徽、贵州、广西等五个中西部省份出现了人口净减少。
而日前QQ基于8亿多活跃用户,通过大数据分析首次披露“逃离北上广”数据图。数据显示,2014年1月16日至2月1日,共计4907万人从北上广深四城回到全国各地,占四地总用户数的51%。节后,约1070万的人真正逃离了北上广深,逃离率为11%,其中,北京又以18%的逃离率成为人们最想逃离的城市。其余的人选择继续他们的打拼之路,再次离开亲人,义无反顾踏上回归北上广之路。
从2014年2月2日至2月25日,1994万用户在2014年首次从全国各地来到北上广深,新增率达到21%。其中近7成是18至29岁的年轻人,而北京凭借27%的涌入率,再次夺冠,成为人们最愿意来此打拼的城市。
解读规律探索规律坚守规律这样的知识求索,比解读政府工作报告往往更有意思也更有用,更能知道社会发展的潮流和方向。大数据是全数据,不带有任何取样的倾向性,也减少了取样的局限性。样本越大,真实准确率越高。有人提出,以QQ登录地作为统计根据,统计比例不会太科学,尤其是逃离部分,竞争力下降的中年以上农民工未必上QQ,这部分人处于自然规律和制造业萧条考量,应该才是逃离的主力,而新增部分应该是可信的,年轻人几乎很少不用QQ的。
这个分析有道理。也就是说,真正逃离北上广深的实际上不止11%,而“逃往”北上广深的21%,则比较接近真实数据。
但考虑到有关部门公布的2013年年末北京常住人口2114.8万;上海市常住人口2415.15万。广州估计1300万,深圳估计1100万左右,合计6930万,比QQ在这四城市的登录用户总数(4907÷51%=9621)还少2691万,当然这也许可以解释为多出部分为瞬间流动人口。再考虑到相当比例中年以上的农民工和中老年人不上QQ(这个比例也是确定的,就是QQ有8亿多活跃用户,全国13.7亿人,活跃用户与非活跃用户之比为8:5.7),因此我们可以推算,2013年底,北上广深四地活跃用户与非活跃用户分别为9621万和6855万。那么,包含瞬间流动人口在内,北上广深四城市2013年底的实际人口数量并非官方公布的6930万,而是高达1亿6476万。
考虑到北上广深的城市特征和年龄结构偏年轻的特征,而其余大量待在农村的人口不用QQ等,上述人口总数可以作适当修正,那么我们可以估计这四大城市的实际人口当也在1亿2000万上下,比官方公布的数据多出近一倍。
这个数据,可以从实际生活中得到验证。2013年某日在一个饭局上,某位从小和大大在一个大院里长大、其母亲对大大兄弟们还多有照顾的、对公共事务几乎不食人间烟火的生意人说,北京公安的朋友告诉他,北京的人口(含瞬间流动人口)实际上已经超过4千万。
为什么实际人口4千万,但官方数据只有2100多万?瞬间流动人口没有计入只是一部分原因(因为不可能那么多),还有一部分原因我猜是因为官方的主流意识形态一直在以资源有限理论控制大城市人口,实际人口与他们想控制的人口规模差别太大,将会揭示资源有限理论和人口控制理论的谎言破产。这个理论一破产,再提控制大城市人口就没有依据了,而且因为日积月累积重难返,他们将面临如何解决流动儿童就学、高考等巨大现实压力。
我们再来看“逃往”北上广深的人群。QQ大数据显示,1994万用户年后首次从全国各地来到北上广深四地。请注意,这里不含刚毕业的700多万大学生(学生6、7月才离校),大学生留在这四地的比例达到一半以上。智联招聘根据简历库数据分析显示,高校毕业生初次就业集中在北京、上海、广州、深圳四大城市的比例高达54.1%,毕业三年后在这四大城市就业的更是高达57.3%。
也就是说,每年北上广深四大城市新增就业人口将达到1994+350=2344万,而流出人口则近半。这2344万是个什么概念?国家统计局数据显示,2002年至2011年,中国城镇化率以平均每年1.35个百分点的速度发展,城镇人口平均每年增长2096万人。(2012年8月17日中国新闻网)也就是说,每年新进入北上广深四大城市的人口总量超过每年从农村进入城市的人口总量。
这样一分析,中国的城市化路径就变得很清晰了:中国的城市化过程,不仅是农村包围城市、农民成为市民的过程,而且是从小城市到大城市的过程。相当多人,包括大学毕业生,包括刚洗脚离田的青年农民,都是一步到位先进入大城市,然后其中一半左右的人,在经过大城市多年的熬煎与洗礼之后,因为种种原因再向中小城市分散。而大部分的人,则留在了大城市!QQ大数据表明,节后未返回北上广深的人群,大部分流向了山东、河南、湖南、安徽以及除广州深圳外的广东其他地区,在家乡附近的二三线城市找到了他们新的天地。
这一切说明了什么?说明市场规律不听领导和决策的指挥棒,反过来则说明决策不尊重公民自由、不尊重市场规律。如今我们三四线以下城市大跃进已经制造了大量空城,留下了巨额债务,给未来中国经济社会留下巨大隐患,但我们仍然在意气风发地“深入实施区域发展总体战略,优先推进西部大开发,全面振兴东北地区等老工业基地……”(《2014年政府工作报告》)我们仍然在以大无畏的精神说:“北京人口调控的当务之急是要痛下决心,坚决遏制住人口无序过快增长的势头,要抓好以业控人,坚决淘汰吸引流动人口过多的产业。”
城市化是经济自由和个人自由的必然结果,大城市化是资源节约、效率提高、人类自由与能量充分施展的必然要求和必然结果,也是浩浩荡荡势不可挡的全球性规律,顺之者繁荣昌盛,逆之者萧条衰败。任何把城市化当成经济增长、“城乡均衡发展”和“疏散大城市人口”的目的,最后都一定会遭遇失败的命运。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Pandas 多列条件筛选:从基础语法到实战应用 在数据分析工作中,基于多列条件筛选数据是高频需求。无论是提取满足特定业务规则的 ...
2025-08-12游戏流水衰退率:计算方法与实践意义 在游戏行业中,流水(即游戏收入)是衡量一款游戏商业表现的核心指标之一。而游戏流水衰退 ...
2025-08-12CDA 一级:数据分析入门的基石 在当今数据驱动的时代,数据分析能力已成为职场中的一项重要技能。CDA(Certified Data Anal ...
2025-08-12破解游戏用户流失困局:从数据洞察到留存策略 在游戏行业竞争白热化的当下,用户流失率已成为衡量产品健康度的核心指标。一款游 ...
2025-08-11PyTorch 中 Shuffle 机制:数据打乱的艺术与实践 在深度学习模型训练过程中,数据的呈现顺序往往对模型性能有着微妙却关键的影响 ...
2025-08-11数据时代的黄金入场券:CDA 认证解锁职业新蓝海 一、万亿级市场需求下的数据分析人才缺口 在数字化转型浪潮中,数据已成为企业核 ...
2025-08-11DBeaver 实战:实现两个库表结构同步的高效路径 在数据库管理与开发工作中,保持不同环境(如开发库与生产库、主库与从库)的表 ...
2025-08-08t 检验与卡方检验:数据分析中的两大统计利器 在数据分析领域,统计检验是验证假设、挖掘数据规律的重要手段。其中,t 检验和卡 ...
2025-08-08CDA 数据分析师:解锁数据价值的专业力量 在当今这个数据爆炸的时代,数据已成为像石油一样珍贵的战略资源。而 CDA 数据分析师, ...
2025-08-08人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-08-07SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07CDA 数据分析师考试全解析 在当今数字化时代,数据已成为企业发展的核心驱动力,数据分析师这一职业也愈发受到重视。CDA 数据分 ...
2025-08-07大数据时代的隐患:繁荣背后的隐忧 当我们在电商平台浏览商品时,系统总能 “精准” 推送心仪的物品;当我们刷短视频时,算法 ...
2025-08-07解析 F 边界检验:协整分析中的实用工具 在计量经济学的时间序列分析中,判断变量之间是否存在长期稳定的均衡关系(即协整关系) ...
2025-08-07CDA 数据分析师报考条件详解:迈向专业认证的指南 在数据分析行业蓬勃发展的当下,CDA 数据分析师认证成为众多从业者提升专业 ...
2025-08-07通过 COX 回归模型诊断异常值 一、COX 回归模型概述 COX 回归模型,又称比例风险回归模型,是一种用于生存分析的统计方法。它能 ...
2025-08-07