京公网安备 11010802034615号
经营许可证编号:京B2-20210330
郭华东:空间地球大数据—地球科学研究的新引擎
大数据对科技发展正在产生重要影响,同时也为地球科学的深入研究带来了重要发展机遇。本期,我们邀请中国科学院院士郭华东通过分析对地观测技术及大数据的发展,探讨空间地球大数据理念,剖析空间地球大数据科学内涵,讨论空间地球大数据与数字地球关系,分析空间地球大数据对推动地球系统科学及全球变化发展的潜力,并在此基础上提出空间地球大数据服务于“一带一路”等经济建设领域的建议。
A 大数据是国家新型战略资源
19世纪70年代以来,随着第二次工业革命的爆发,各种新技术、新发明层出不穷,以文字为载体的数据量大约每10年翻一番;从工业化时代进入到信息化时代后,信息技术革命以前所未有的方式对社会、科技、经济变革的发展起着决定作用,数据量以每3年翻一番的速度持续增长;近10年来,随着计算机技术和互联网的快速发展,音频、视频、文字、图片等半结构化、非结构化的数据大量涌现,社交网络、物联网、云计算被广泛应用,使得数据存储量、规模、种类飞速增长,大数据时代已悄然来临。
2014年4月,国际数据公司(IDC)发布的第七份“数字宇宙”研究报告指出,全球数据总量将以每两年翻一番的速度持续增长。大数据的重要性犹如工业社会的“石油”资源,谁掌握了数据,谁就掌握了主动权。大数据已成为信息主权的一种表现形式,将是继边防、海防、空防之后,另一个大国博弈的空间。
可以说,大数据正在改变科学的发展。大数据技术与应用已成为继实验、理论和计算模式之后的数据密集型科学范式的典型代表,正在带来科研方法论的创新:科学大数据将复杂性、综合性、全球性和信息与通信技术高度集成性等诸多特点融于一身,其研究方法也正在从单一学科向多学科、跨学科方向转变、从自然科学向自然科学与社会科学的充分融合方向过渡、从个人或者小型科研团体向国际科技组织方向发展。另外,科学家不仅通过对广泛的数据进行实时、动态地监测与分析来解决科学问题,更是将数据作为了科学研究的对象和工具,即数据驱动的知识发现。这正是科学大数据的核心价值所在。
B 空间地球大数据驱动地球科学发展
所谓空间地球大数据,是指从空间观测地球获取地表及次地表的大数据,并通过数据密集型科学分析人与地球和自然现象的规律。空间地球大数据具有海量(高分辨率、高动态新型传感器波段数量多、光谱和空间分辨率高、数据速率快、周期短)、多源(数据来源和获取手段多样)、多时相(采样间隔缩短,数据获取频率幅度增大)等特征,因其有宏观、客观、快速、准确、全面获取数据的特点和能力,对地球科学,尤其是地球系统科学的发展起到了革命性的推动作用,在环境、资源、灾害等领域有重要作用和经济社会价值。
地球系统科学以地球为一个巨型系统研究,需要空间地球观测数据的参与,从而降低系统复杂度,使建模和求解成为可能。在地球科学长期发展的基础上,半个世纪以来从空间观测地球的新视野新方法,不断加深着对地球的理解特别是宏观认识。随着遥感、导航定位、地球物理等卫星数量和其他平台的不断增加以及观测仪器类型的多样化,空间地球大数据正在汇入大数据研究的主流,为地球科学研究带来了新机遇,作为思维与方法论的创新与革命,有望为推动地球科学深度发展并产出重大科学发现作出贡献。
我国空间对地观测技术经过40年的发展,自主卫星遥感技术、北斗导航卫星技术等数据获取技术得到长足的发展,相应的地面接收基础设施和数据处理系统水平、规模与服务能力也与国际同行。相信空间地球大数据时代的到来,以及数据驱动科学范式的建立,将大大推动包括数字地球、全球变化、未来地球、灾害科学等领域的研究及空间地球信息科学的学科发展,并将为我国“一带一路”等国家战略提供支撑服务,包括沿线国家的生态环境、资源能源、农业、减灾、自然与文化遗产保护等重大问题方面发挥历史性作用。
C 加快国家大数据建设进程
大数据是知识经济时代的战略高地,大数据是国家新型战略资源,大数据正在改变人类生活及对世界的深层理解。在大数据时代,庞大繁杂的数据对社会、科技、经济的发展将发挥支撑促进作用,其所蕴含的战略价值已引起多数发达国家政府重视,一些国家和国际组织已将大数据研究提升到国家和国际重大战略层面,相继出台了大数据战略规划和配套法规促进大数据应用与发展,这势必对未来科技与经济发展带来深远影响。
目前,我国在该领域面临难得的发展机遇,与世界各国同处大数据起步阶段:我国的计算机用户数全球第一,互联网用户数全球第一,移动互联网用户数全球第一;我国拥有的数据现在占全球16%左右,2020年这一比例将高达21%;我国发表的大数据论文目前国际排名第二位,正在呈现快速发展趋势。如此情势下,完全有条件借国家全面深化改革的东风,优化体制机制,整合各类资源,将大数据上升为国家战略,加强大数据的顶层设计,系统规划,通过出台大数据国家行动计划、建立大数据国家平台及国际联盟等举措,把大数据做大做强,使大数据成为服务国家、引领世界的一个引擎。
为此,提出加快国家大数据建设进程的三点建议:
第一,将大数据定位为国家战略。大数据应该是国家战略,其发展应体现核心性国家意志,应加强大数据的顶层设计,系统规划。同时,注重大数据政策法规、伦理道德问题。大数据监管或政策应先行,监管可遵循“红绿黄灯”原则,尤其要加快绿灯政策和绿灯配套措施建设。目前,包括数据共享在内的我国数据政策还在徘徊阶段,大家期待形成一个绿灯闪烁、大国数据潮流破浪涌动的局面。
第二,出台大数据国家行动计划。构建大数据国家重大基础设施,建设一批科学大数据应用服务中心,一批学科交叉大数据科学研究中心,推出人才培养计划。设立研究专项,比如李克强总理数次提到胡焕庸线是否可以破解的“三问”,即“胡线”该不该打破?是否可以打破?如何打破?“胡线”的形成历经近千年的长时间尺度和跨越几千公里的大空间尺度,蕴藏着超长时空序列科学内涵,可通过大数据研究为总理“三问”提供科学依据。
第三,建立大数据国家组织及国际联盟。例如,面向国家“一带一路”战略,构建丝绸之路和海上丝绸之路大数据联盟。以大数据为抓手,为“一带一路”注入可操作、可凝聚、能引领的方向,形成出钱的基金会—出思想的科学家—出成果的大数据基础设施等各方联动大格局,让大数据成为“一带一路”建设的一个引擎,让大数据成为各国共建“一带一路”的和平使者,让大数据科学之光普照“一带一路”的现在和未来。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27