京公网安备 11010802034615号
经营许可证编号:京B2-20210330
Hadoop大数据重构智能交管
2015年7月23日,中国Hadoop技术峰会在上海浦东嘉里中心如火如荼地召开。下午的大数据应用分论坛,基于最新的大数据技术,结合落地应用案例进行讲解与讨论,也受到了业内外的广泛关注。
当日下午,来自公安部交通管理科学研究所的方艾芬主任在大数据应用分论坛上发表了题为《大数据在交通管理中的应用》的讲演,从技术革新到落地案例,多方面多角度地阐释了Hadoop大数据平台对交通管理方面的帮助与改革。
方主任首先对公安部交通管理研究所的性质与职能作了简要介绍。交通管理研究所是公安部直属的道路交通管理工程技术研究的科研机构,主要从事道路交通事故预防及鉴定技术、公安交通管理业务信息化技术、公安交通管理大数据技术及云计算技术、智能交通管理技术等技术领域的研究工作。
方主任的讲演从公安交通管理信息化的现状,机动车缉查布控大数据平台建设及应用实践和未来交通管理信息化展望三方面来召开。
首先是公安交通管理信息化的现状,我国机动车的保有量为2.71亿,其中汽车保有量1.63亿,仅次于美国,位列世界第二。而驾驶人数量3.12亿则为世界第一。我国公路通车里程达到446.39万公里,其中高速11.19万公里。这些背景数据说明我国已进入汽车社会。对于道路交通管理的需求与压力也与日俱增。
2012年起,公安部推出全国公安交通管理综合平台,在全国31个省、480多个地级市全面应用。公安交通管理主要业务全面信息化。同时,以公安交通管理综合应用平台为依托、以各地卡口系统为基础的全国机动车缉查布控系统也已应用,实现了缉查布控、预警拦截、轨迹分析、综合研判四方面的公安公路交通安全联网管控信息化。

卡口系统主要进行图像抓拍、通行记录等数据处理,并实时上传至缉查布控系统。目前,全国联网接入卡口23000多个,已汇聚上传车辆轨迹数据350亿多条,每日新增1亿多条。同时,机动车通行数据,车辆、驾驶证等基础数据,运维监管等其他数据也达到上亿条并且仍保持增长趋势。这些数据既包括常规的结构化数据,也包括图片、视频等非结构化、半结构化数据,价值巨大。
然而庞大的数据量也带来了一些问题。比如海量的数据中有百分之九十九的数据从未被使用,极低的利用率使得相关部门只能被动地通过数据解决已有问题,而无法使用现有数据进行分析、监管。究其原因,在于传统的关系型数据库面对如此庞大的数据量,无法进行高效的处理,受此限制,大部分的数据也发挥不出本来的价值。
然而现有数据量仍然在不断地增长,这一问题对数据库的革新提出了要求,传统关系型数据库向分布式数据库的转型势在必行。
方主任借此背景,引出了机动车缉查布控大数据平台建设与应用实践的成功经验。
大数据平台的建设需求在于应用大数据、云计算等技术,建设省级、部级机动车缉查布控大数据平台,汇聚全省、全国机动车轨迹信息,实现海量数据的接入、存贮,实现过车查询、全库搜索、轨迹分析、套牌分析、伴随分析、碰撞分析、区间测速等实时分析应用,实现跨部门、跨警种、跨区域信息共享和深度挖掘应用,为准确监测公路通行状况、快速缉查交通违法行为、打击各类涉车违法犯罪,不断提升道路交通安全管控水平、决策分析和社会服务能力提供全新技术实现手段。
而公安交管部门的大数据平台以大范围碰撞比对作为主要目标,是国内较早落地应用大数据平台的案例。方主任以省级平台——山东省缉查布控大数据平台案例作为主要讲解对象。
数据方面,山东省缉查布控大数据平台已在17个地市联网接入卡口1000多套,日过车记录超过1000万条(预期全面联网后1到1.5亿条每天)。全省2300多万机动车,3000多万驾驶人进入关联信息。自2014年9月正式运行起,已累积近40亿条,25TB数据。
架构上采取混合型架构,部分数据存储于HBase分布式数据库,一些关键数据存储于Oracle数据库,采用企业级发行版Hadoop软件,解决了数据实时处理,快速查询检索和多维度分析研判等问题。
方主任还提到在软件平台上,选择了星环科技的TDH产品,从2014年9月运行至今,性能稳定可靠,用户体验极佳。

基于大数据平台,公安交管部门能根据海量数据提取信息,分析轨迹,在一秒之内实现实时比对,产生预警,从而有针对性地干预、拦截。动态静态信息的碰撞比对,解决了许多过去的难题。比如逾期未年检车辆的发现与预警,无论是车主的无心之失或有意为之,都为公安部门的监管带来了极大的便利。同时还有假牌套牌分析处理与核对等,这是过去的监管系统难以顾全的。
总的来说,借助大数据TDH平台的帮助,公安交管部门相较之前更好地利用到了已有的数据,有力提升动态化、信息化执法能力,提升了对重点车辆动态监管能力,提升了对路面重点交通违法行为动态发现能力,提升了对机动车通行情况的分析研判能力,提升了对各地执法情况的监督能力,提升了对源头企业的监管能力。
而在未来,计划建立全国公安交通集成指挥平台,基于关联系统、平台信息,落成部省市三级全国联网监控。公安部交通管理科学研究所目前正依托全国公安交通管理数据中心、 云计算和大数据应用联合实验室, 开展交管大数据应用模式、技术架构、研判分析和预测模型研究,研发基于云计算技术的交通管理大数据挖掘研判系统。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05