京公网安备 11010802034615号
经营许可证编号:京B2-20210330
如何解决政府大数据躺在档案柜里“睡大觉”
政府大数据应用效率低 应重视和认知几个问题
近日,第十二届全国政协第三次会议和第十二届全国人大第三次会议正在北京召开中。会上,来自全国各地的代表委员们共商国家大事,热议民生问题,总结过去,规划未来。今年两会两会上,有几个十分引人关注的问题,大数据就是其中一个。
第十二届全国人大代表孙丕恕在会上指出,“随着电子政务建设的不断发展,各级政府积累了大量与公众生产生活息息相关的数据,并成为社会上最大的数据保有者,掌握着全社会信息资源的80%,其中包括3000余个数据库。”而事实上,我国政府大数据利用状况却极不理想,很多政府数据躺在相关部门的档案柜里“睡大觉”。
坚持不懈地呼吁源自一种紧迫感。“西方主要发达国家都将其政府数据开放作为国家战略推动,借助政府数据开放,美国的医疗服务业节省3000亿美元,制造业在产品开发、组装等环节节省50%的成本。”孙丕恕说,目前,上海、北京、青岛等地先后出台了数据开放相关政策,搭建了政府数据开放平台,但也存在一系列问题。
他认为,这些问题集中表现在缺乏顶层设计和统筹规划、推动措施,很多政府部门担心增加工作负担,甚至顾忌数据披露会暴露管理中的不足,因而主动性不强;相关数据安全、隐私保护法律不健全,缺乏统一数据开放标准,地方政府和垂直系统各自为战,造成新的“开放的数据孤岛”。
“在国外,数据开放的工作都有明确的部门来负责,有效推动了这项工作的进展。例如,美国的data.gov是由美国总务管理局(General Services Administration)负责管理,并持续改进该网站。美国行政管理和预算局(Officeof Managementand Budget)负责设计网站的结构与规划。”孙丕恕建议,我国政府数据公开应明确组织机构,制定行动规划,研究制定政府数据开发目录和格式标准,“书同文、车同轨”。
从建设步骤和开放范围来看,他建议按照先易后难、分步实施的原则,逐步在全国分领域、分区域实施。“建议选择试点区域,推动相关部门首先整理社会关注度高,与居民生活、公共服务、社会环境和环境保护等方面相关的数据,例如气象、交通、旅游、物价等部门所掌握的基础数据、业务类数据、管理类数据、统计类数据等。”
除了唤醒“沉睡”的政府数据,在孙丕恕看来,当前应该积极推进金融、电商、公共事业等大型企业数据的开放共享,在信用体系建设方面用好大数据。
“目前,金融信用信息基础数据库已经为1859.6万户企业和其他组织及8.2亿自然人建立了信用档案,这些数据第三方机构很难获得。”孙丕恕说,当前央行征信也在逐步建立信用的共享机制,但大部分局限于金融机构内部,没有有效地向社会开放。电信运营商、水电煤等公共事业机构内也积累了多年的业务数据,互联网公司则收集了大量的用户和企业信用数据,这些公司基于商业利益等不将数据开放,而是基于自有的局部数据开展征信服务业务。“目前,个人征信市场已向民营企业开放,大企业间也在积极谋求数据获取和数据共享的路径,如建立数据开放平台引入或交换第三方数据,但这些都缺乏明确的规范和政策,这一领域的数据壁垒问题亟需解决。”
政府大数据应用,应重视和认识的几个问题:
一是国家优先发展战略。大数据应用领先国家的所有大数据项目,都具有国家优先发展的相关目标(比如数据的开放和已获得,公民更好参与公共事务)。对大数据应用的主要关注点集中于安全、速度、交互性、分析能力,和缺少胜任的专业人员。然而,每个国家的政府基于其独有的环境,有自身的优势、机会和威胁。
二是分析机构。对于跨部门的数据,管理和综合数据需要一个自上而下的统筹。政府应建立一个大数据控制中心以综合各部门既有数据的数据库,包括结构化和非结构化的。此外,政府还需要建立一个先进的分析机构负责开发战略,处理大数据如何通过新技术平台进行管理和分析,如何招募到熟练的从业人员。
三是实时分析。政府需要管理即时更新的大数据,并进行实时分析,同时保护个人信息安全,还需要探索的新技术平台(比如云计算,先进分析和安全技术)。相当多的政府数据在性质上是全球化的,而且能够被用于预防和解决全球事务,因此必须开展全球合作。
四是国际化。各国政府间努力集成和共享地球观测数据。全球地球观测系统,是一个全球性的公共基础设施,产生了综合的、接近实时性的环境数据,目的是为全球使用者和决策制定者提供信息以供分析。政府也需要共享与安全威胁、诈骗和非法活动相关的数据。这种大数据需求不仅需要转换技术,还需要国际化的协作去共享和综合数据。
五是ICT专业公司。政府应该与ICT专业公司合作。例如,亚马逊AWS关联很多公共数据集,包括日本、美国人口调查数据和许多基因组及医疗数据库。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、机器学习的实操场景中,聚类分析与主成分分析(PCA)是两种高频使用的统计与数据处理方法。二者常被用于数据预处理 ...
2026-02-24在聚类分析的实操场景中,K-Means算法因其简单高效、易落地的特点,成为处理无监督分类问题的首选工具——无论是用户画像分层、 ...
2026-02-24数字化浪潮下,数据已成为企业核心竞争力,“用数据说话、用数据决策”成为企业发展的核心逻辑。CDA(Certified Data Analyst) ...
2026-02-24CDA一级知识点汇总手册 第五章 业务数据的特征、处理与透视分析考点52:业务数据分析基础考点53:输入和资源需求考点54:业务数 ...
2026-02-23CDA一级知识点汇总手册 第四章 战略与业务数据分析考点43:战略数据分析基础考点44:表格结构数据的使用考点45:输入数据和资源 ...
2026-02-22CDA一级知识点汇总手册 第三章 商业数据分析框架考点27:商业数据分析体系的核心逻辑——BSC五视角框架考点28:战略视角考点29: ...
2026-02-20CDA一级知识点汇总手册 第二章 数据分析方法考点7:基础范式的核心逻辑(本体论与流程化)考点8:分类分析(本体论核心应用)考 ...
2026-02-18第一章:数据分析思维考点1:UVCA时代的特点考点2:数据分析背后的逻辑思维方法论考点3:流程化企业的数据分析需求考点4:企业数 ...
2026-02-16在数据分析、业务决策、科学研究等领域,统计模型是连接原始数据与业务价值的核心工具——它通过对数据的规律提炼、变量关联分析 ...
2026-02-14在SQL查询实操中,SELECT * 与 SELECT 字段1, 字段2,...(指定个别字段)是最常用的两种查询方式。很多开发者在日常开发中,为了 ...
2026-02-14对CDA(Certified Data Analyst)数据分析师而言,数据分析的核心不是孤立解读单个指标数值,而是构建一套科学、完整、贴合业务 ...
2026-02-14在Power BI实操中,函数是实现数据清洗、建模计算、可视化呈现的核心工具——无论是简单的数据筛选、异常值处理,还是复杂的度量 ...
2026-02-13在互联网运营、产品迭代、用户增长等工作中,“留存率”是衡量产品核心价值、用户粘性的核心指标——而次日留存率,作为留存率体 ...
2026-02-13对CDA(Certified Data Analyst)数据分析师而言,指标是贯穿工作全流程的核心载体,更是连接原始数据与业务洞察的关键桥梁。CDA ...
2026-02-13在机器学习建模实操中,“特征选择”是提升模型性能、简化模型复杂度、解读数据逻辑的核心步骤——而随机森林(Random Forest) ...
2026-02-12在MySQL数据查询实操中,按日期分组统计是高频需求——比如统计每日用户登录量、每日订单量、每日销售额,需要按日期分组展示, ...
2026-02-12对CDA(Certified Data Analyst)数据分析师而言,描述性统计是贯穿实操全流程的核心基础,更是从“原始数据”到“初步洞察”的 ...
2026-02-12备考CDA的小伙伴,专属宠粉福利来啦! 不用拼运气抽奖,不用复杂操作,只要转发CDA真题海报到朋友圈集赞,就能免费抱走实用好礼 ...
2026-02-11在数据科学、机器学习实操中,Anaconda是必备工具——它集成了Python解释器、conda包管理器,能快速搭建独立的虚拟环境,便捷安 ...
2026-02-11在Tableau数据可视化实操中,多表连接是高频操作——无论是将“产品表”与“销量表”连接分析产品销量,还是将“用户表”与“消 ...
2026-02-11