大数据让人看到更真实的历史
大数据研究不仅能预测人未来的行为,也能让我们更清晰地看清过往的历史。斯坦福大学Clark教授说,“历史只有工业革命前后之分,其他的历史细节虽然很有意思,但不关键。”为什么呢?一方面,世界人均GDP在公元1800年前的两三千年里基本没有变化,工业革命之后才逐渐上升;另一方面,工业革命之后人类生活方式、社会结构、政治形态以及文化内涵都有了本质性变革。
公元元年时世界人均GDP大约为445 美元 (按1990年美元算),到1820年上升到667美元,1800多年里只 增长 了50%。同期,西欧国家稍微好一些,但也只是从公元元年的450美元增长到1820年时的1204美元,英国作为工业革命的发源国也大致如此。而从1820年到2001年的180年里,世界人均GDP从原来的667美元增长到6049美元。由此可见,工业革命带来的收入增长的确是翻天覆地的。
工业革命之前的人类既然没有实现财富增长,那么他们都在忙些什么呢?那个时期,不管是东方还是西方,有很多改朝换代,但Clark教授认为,“用不着被那些表面的东西所误导”,在工业革命之前,人类社会一直没有走出“马尔萨斯模式”,即在生产率不变的情况下,自然灾害或战争导致人口死亡,使接下来的人均收入增加,为生育率上升、人口增长提供条件,可是人口增长后,人均土地和人均收入会减少,使生存挑战越来越大,又导致战争的发生并使接下来的人口又减少,在这个周期中循环。
Clark教授通过对英国人遗嘱研究发现,在工业革命之前,英国人的生育率跟财富水平高度正相关:越有钱的夫妻,小孩数量越众。在16世纪期间,最富的三分之一英国人死时平均还有4至6个小孩健在,中等财富的英国人离世时平均有3.5到4.5个小孩健在,而最穷的三分之一英国人离世时只有不到3个小孩活着。到18世纪末,基本情况仍然是越富有的家庭小孩数越多,只是每家的小孩数量都降到4个以下,并且各财富阶层间的小孩数量差距明显缩小。
工业革命到来之后,小孩数量就基本跟财富水平没有关系了。而从1880年到1980年的100年间,情况正好反过来:越穷的英国人,小孩数量反而越多,完全改变了工业革命之前“适者生存”、“有钱者生存”的规律。穷者还是追求小孩数量,而富者更注重小孩的质量和自己的生活品质。Clark教授发现工业革命之后,虽然穷人的小孩数更多,但富人的平均寿命更长,这可能是后者更侧重生活质量的结果。
Clark教授的研究结果对中国的历史研究也很有启发。公元元年时中国的人均GDP为450美元(跟西欧一样),到洋务运动的起点时也仅为530美元。在人们的基本生活水平几千年没有变化的情况下,那些制度与文化体系是经历了几千年的检验,还是只经历了几年、一两个朝代的考验,并不存在本质性差别。从这个意义上讲,在收入与生活方式处于静态不变的状况下,那些朝代到底叫“汉朝”、“隋朝”、“唐朝”、“宋朝”,还是“元朝”、“明朝”或“清朝”,这些细节意义不是那么大,至少没有原来我们强调的那么大。
鸦片战争敲开了国门,洋务运动把工业革命请进中国,由此真正把引发社会变革的工业技术和相配思维方式带入中国,让中国有机会走出困扰社会几千年的马尔萨斯式陷阱,结束过去重复的静态朝代更替周期。
玉米和红薯曾这样影响中国
瑞典斯德哥尔摩大学贾瑞雪教授研究中国历年农民暴动起义跟自然灾害的关系。她的量化历史研究发现:在16世纪玉米、红薯进中国前,干旱年里平均每12个州府地区就有一个发生农民起义或暴动,而玉米、红薯于16世纪引进中国后,即使在干旱年,每40个州府才有一个发生农民起义。主要原因在于这些“新世界”粮食作物对水稻有很强的补充作用。从这个意义上说,虽然红薯、玉米不像大米那么受欢迎,但是在干旱年份,如果是在暴动起义和红薯、玉米之间做选择,农民更愿意选择后者。
哥伦布发现美洲后,西班牙人先是从现在的墨西哥把玉米、红薯和土豆带回欧洲。按照学者估算,仅土豆一项就使欧洲人口在1700-1900年两百年间增长25%,使欧洲城市化率从27%到35%,并帮助催化了工业革命的发生。
这些作物随后传入中国。香港科技大学龚启圣教授和他的合作者要研究的问题主要有三个:第一,到底是因为引进了这三项农作物使中国人口从1500年的1.3亿上升到1900年的4亿,还是因为中国人口已经增长太多,到16、17世纪不得不寻找新的粮食作物?第二,如果是这些新作物激发了中国人口增长,其具体贡献有多大?第三,这些新作物是否也催化了中国的人均收入增长?
他们找到了23个省1330个县的县志,从1550年左右开始研究各县志哪年首次提到玉米,依此勾画出玉米在中国的扩散途径和持续时间。他们发现,玉米最早是经三条路径进入中国:第一条路径是丝绸之路,玉米经中亚于1560年左右进入甘肃,第二条是经印度于1563年进入云南,第三条途径是经菲律宾于1572年进入福建。
接下来,龚教授把引进了玉米的县和还没引进玉米的邻县,形成两个样本,比较这两组县每隔十年的人口密度差别。在考虑到自然灾害、战争死亡等因素之后,他们的数据分析发现:按照1776年、1820年、1851年、1890年、1910年几个时间点看,在每个时期,已经引进玉米的县人口密度明显高于没有引进玉米的县,而且一个县已经种植玉米的年份越长,其人口密度高出的就越多。种玉米的时间每多十年,其人口密度就多增5%-6%。
经过各种严格计量方法的验证,他们得出的结论为:是玉米带动了中国的人口增长,而不是人口增长压力迫使中国引进玉米、红薯。而且从1776年到1910年间,中国14.12%的人口增长是由玉米所致。而从16世纪初到20世纪初,中国粮食增量的55%是由于这三项新作物。
数据分析咨询请扫描二维码
CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01某家企业10个人面试,有9个本科生……如何脱颖而出,除得体的举止和良好的沟通力外,证书成重要筹码,这也是很多人考证的关键所在。
2022-04-14