京公网安备 11010802034615号
经营许可证编号:京B2-20210330
QQ大数据:年轻人逃离北上广了吗_数据分析师
早在2000年,诺贝尔经济学奖得主斯蒂格里茨就说过:21世纪影响人类进程有两件大事,一是以美国为首的新技术革命;一是中国的城市化。
当下中国已经有一个基本共识,就是没有城市化就没有中国的现代化。但是,出于精英阶层对大城市化和所谓“城市病”的恐惧;出于文人思维中区域均衡发展的乌托邦梦想;出于权力的傲慢与自负,当代中国的城市化进程一直存在着规律与规划撕裂、人口流动与政府导向背离等现象。它一方面导致人口净流出地区的过度投资和过度城市化,造成各种资源的巨大浪费。不把钱当钱,一直在搞小城镇大跃进,西部大开发,就地城镇化。另一方面导致人口净流入地区,尤其是流入大城市人口的各项基本自由和权利得不到保障,不把人当人,无视人的自由选择和自由迁徙权利,大城市想尽一切办法通过收容遣送(已废除)、户籍管制、学籍限制、产业强迁等往外“赶人”。
但事实证明以西部大开发和小城镇战略为代表的“区域均衡发展战略”是失败的。在产出和投入比中,东部一直最高,中部其次,西部和东北一直垫底;在经济发展上,西部与东部的差距越来越大。西部人口也持续外流。从国家统计局提供的数据看,在2001至2012年的11年中,河南、四川、安徽、贵州、广西等五个中西部省份出现了人口净减少。
而日前QQ基于8亿多活跃用户,通过大数据分析首次披露“逃离北上广”数据图。数据显示,2014年1月16日至2月1日,共计4907万人从北上广深四城回到全国各地,占四地总用户数的51%。节后,约1070万的人真正逃离了北上广深,逃离率为11%,其中,北京又以18%的逃离率成为人们最想逃离的城市。其余的人选择继续他们的打拼之路,再次离开亲人,义无反顾踏上回归北上广之路。
从2014年2月2日至2月25日,1994万用户在2014年首次从全国各地来到北上广深,新增率达到21%。其中近7成是18至29岁的年轻人,而北京凭借27%的涌入率,再次夺冠,成为人们最愿意来此打拼的城市。
解读规律探索规律坚守规律这样的知识求索,比解读政府工作报告往往更有意思也更有用,更能知道社会发展的潮流和方向。大数据是全数据,不带有任何取样的倾向性,也减少了取样的局限性。样本越大,真实准确率越高。有人提出,以QQ登录地作为统计根据,统计比例不会太科学,尤其是逃离部分,竞争力下降的中年以上农民工未必上QQ,这部分人处于自然规律和制造业萧条考量,应该才是逃离的主力,而新增部分应该是可信的,年轻人几乎很少不用QQ的。
这个分析有道理。也就是说,真正逃离北上广深的实际上不止11%,而“逃往”北上广深的21%,则比较接近真实数据。
但考虑到有关部门公布的2013年年末北京常住人口2114.8万;上海市常住人口2415.15万。广州估计1300万,深圳估计1100万左右,合计6930万,比QQ在这四城市的登录用户总数(4907÷51%=9621)还少2691万,当然这也许可以解释为多出部分为瞬间流动人口。再考虑到相当比例中年以上的农民工和中老年人不上QQ(这个比例也是确定的,就是QQ有8亿多活跃用户,全国13.7亿人,活跃用户与非活跃用户之比为8:5.7),因此我们可以推算,2013年底,北上广深四地活跃用户与非活跃用户分别为9621万和6855万。那么,包含瞬间流动人口在内,北上广深四城市2013年底的实际人口数量并非官方公布的6930万,而是高达1亿6476万。
考虑到北上广深的城市特征和年龄结构偏年轻的特征,而其余大量待在农村的人口不用QQ等,上述人口总数可以作适当修正,那么我们可以估计这四大城市的实际人口当也在1亿2000万上下,比官方公布的数据多出近一倍。
这个数据,可以从实际生活中得到验证。2013年某日在一个饭局上,某位从小和大大在一个大院里长大、其母亲对大大兄弟们还多有照顾的、对公共事务几乎不食人间烟火的生意人说,北京公安的朋友告诉他,北京的人口(含瞬间流动人口)实际上已经超过4千万。
为什么实际人口4千万,但官方数据只有2100多万?瞬间流动人口没有计入只是一部分原因(因为不可能那么多),还有一部分原因我猜是因为官方的主流意识形态一直在以资源有限理论控制大城市人口,实际人口与他们想控制的人口规模差别太大,将会揭示资源有限理论和人口控制理论的谎言破产。这个理论一破产,再提控制大城市人口就没有依据了,而且因为日积月累积重难返,他们将面临如何解决流动儿童就学、高考等巨大现实压力。
我们再来看“逃往”北上广深的人群。QQ大数据显示,1994万用户年后首次从全国各地来到北上广深四地。请注意,这里不含刚毕业的700多万大学生(学生6、7月才离校),大学生留在这四地的比例达到一半以上。智联招聘根据简历库数据分析显示,高校毕业生初次就业集中在北京、上海、广州、深圳四大城市的比例高达54.1%,毕业三年后在这四大城市就业的更是高达57.3%。
也就是说,每年北上广深四大城市新增就业人口将达到1994+350=2344万,而流出人口则近半。这2344万是个什么概念?国家统计局数据显示,2002年至2011年,中国城镇化率以平均每年1.35个百分点的速度发展,城镇人口平均每年增长2096万人。(2012年8月17日中国新闻网)也就是说,每年新进入北上广深四大城市的人口总量超过每年从农村进入城市的人口总量。
这样一分析,中国的城市化路径就变得很清晰了:中国的城市化过程,不仅是农村包围城市、农民成为市民的过程,而且是从小城市到大城市的过程。相当多人,包括大学毕业生,包括刚洗脚离田的青年农民,都是一步到位先进入大城市,然后其中一半左右的人,在经过大城市多年的熬煎与洗礼之后,因为种种原因再向中小城市分散。而大部分的人,则留在了大城市!QQ大数据表明,节后未返回北上广深的人群,大部分流向了山东、河南、湖南、安徽以及除广州深圳外的广东其他地区,在家乡附近的二三线城市找到了他们新的天地。
这一切说明了什么?说明市场规律不听领导和决策的指挥棒,反过来则说明决策不尊重公民自由、不尊重市场规律。如今我们三四线以下城市大跃进已经制造了大量空城,留下了巨额债务,给未来中国经济社会留下巨大隐患,但我们仍然在意气风发地“深入实施区域发展总体战略,优先推进西部大开发,全面振兴东北地区等老工业基地……”(《2014年政府工作报告》)我们仍然在以大无畏的精神说:“北京人口调控的当务之急是要痛下决心,坚决遏制住人口无序过快增长的势头,要抓好以业控人,坚决淘汰吸引流动人口过多的产业。”
城市化是经济自由和个人自由的必然结果,大城市化是资源节约、效率提高、人类自由与能量充分施展的必然要求和必然结果,也是浩浩荡荡势不可挡的全球性规律,顺之者繁荣昌盛,逆之者萧条衰败。任何把城市化当成经济增长、“城乡均衡发展”和“疏散大城市人口”的目的,最后都一定会遭遇失败的命运。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-10在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-10在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01