京公网安备 11010802034615号
经营许可证编号:京B2-20210330
如何才能将视频大数据真正应用起来
在这个信息爆炸的时代,每天都有大量各种各样的信息数据产生,怎么发掘这些海量数据的价值成为所有人关注的重点。因此,上至政府部门,下至平头百姓,各行各业对大数据的讨论越来越激烈,大家都在探寻大数据的奥妙和价值。
大数据说起来比较玄乎,实际上已经慢慢地渗透到我们生活的方方面面。以现在越来越普及的网络购物为例,我们在某购物网站中搜索了某些商品,再次登录该网站,甚至是其他的网站,往往就会看到系统自动推荐的与上次搜索相关的商品信息。这就是购物网站应用大数据分析,摸清了用户的消费习惯,精准推送用户可能感兴趣的产品,以更有效地促进用户消费。这是个人购物行为,再更进一步,每年各大购物网站都会发布一些购物指南,得出了一些非常有趣的结论,比如哪个地区男士为女士购买的商品最多;哪个年龄段的网络消费能力更强;同类产品,哪个品牌在某个区域的销量更好等等,这些都是通过大数据分析得到。目前,政府、医疗、互联网等等行业都已经开始了大数据应用。
大数据与安防
虽然大数据在不少行业都已经开始得到应用,并取得了非常不错的效果,但是就安防行业来说,大数据应用之路才刚刚开启。在安防领域,主要的数据来源是视频,与其他行业结构化的数据不一样,视频是一种非结构化的数据,不能直接被计算机进行处理或分析。因此,安防要进行大数据应用,首先就要采用智能分析技术将非结构化的视频数据转换成计算机能够识别和处理的结构化信息,即将视频中包含的各种信息(主要是运动目标及其特征)提取出来转成文字描述,这样才能通过计算机来对这些视频进行搜索、比对、分析等。但是,早期安防行业并没有有效的技术手段来展开这项工作。
智能分析技术其实很早就已经应用于安防行业,只不过受限于智能分析算法本身以及摄像机的硬件性能,早期主要是通过智能分析服务器来实现视频图像的智能识别和分析,但这种方式存在一个致命的缺陷——成本过高。一台刀片式服务器价格在六七万左右,而一台服务器只能识别七、八路1080P高清监控录像。以一个中等规模的城市为例,整体建设可能有十来万个监控点,即使只做2000路智能分析,也要两百多台服务器,这个成本是相当可观的。除了服务器的设备成本之外,还有服务器的能耗、所占场地、数据中心的网络设备、后期维护等成本,这些成本不比购买服务器的成本低。正是服务器这种智能分析模式因为成本过高无法规模化应用,所以视频信息无法大规模转换成结构化的数据,安防大数据也就一直无法落到实地。
随着智能分析算法的逐步成熟,以及摄像机硬件性能的不断提升,越来越多企业开始考虑将更多智能识别算法前置到摄像机中,毕竟摄像机本身的成本增加是可以预见的。在安防业内,以科达为代表的感知型摄像机这类智能摄像机的推出,比较经济有效地解决了视频数据结构化的问题,为安防大数据应用打下了基础。
除了视频数据的非结构化外,与其他行业相比,安防行业的大数据还有一些典型特征,这些特征对存储系统提出了更高的要求。比如视频的数据量特别大,且还在不断增多,就要求存储系统能够很方便地扩容;视频的价值密度低,且是实时的,连续的,稍纵即逝的,不容丢失,就要求存储的可靠性要高;一个PB级的存储系统硬盘就有几千甚至几万块,这么多硬盘可能每天都会有损坏,如果一损坏就要更换会非常麻烦,这就对存储提出了可维护性的要求;既然是大数据视频,说明会有各种各样的用户会去访问这些视频数据,所以对并发访问会有更高要求等等。要满足上述要求,传统的存储方式已经无能为力,只有云存储才能支撑。
一段视频经过智能摄像机的分析提取以后,形成了原始视频、视频里面每个运动目标的图片以及每个运动目标的语义文字描述三类数据,其中图片和视频是非结构化数据,一般存于云存储系统中,而语义的文字描述这类结构化数据存在于后端的大数据数据库中,每一条文字的描述对应相应的目标图片和视频。在完成了视频的结构化处理,以及三类数据的存储之后,应用就是接下来的关键,否则存储的数据也没有价值。
尽管在不同的垂直行业,安防大数据的应用会有一定差异,但从目前应用最为成熟的公安、交通等行业来看,大数据应用大致可以归结为检索、分析研判、实时布控和调度三大类。
第一类检索,在实现视频结构化之前,查找、检索视频只能靠人,而将视频结构化之后,利用后端的大数据检索系统,就能很方便地搜出相对应的文字、图片以及视频。比如要查找某一时间段经过某个路段一个穿蓝色衣服的可疑人员,用户只需要输入“蓝色衣服”,就能找出该时间段内所有穿蓝色衣服的人的图片,点击图片就可以获取这个人经过这个路段的视频。
第二类分析研判,比如通过车辆的多点碰撞,看是否有哪辆车在几个路口都出现过,从而帮助公安发现嫌疑车辆。
第三类是实时布控和调度,比如,公安知道一个嫌疑人住在某个小区,并且嫌疑人照片已经存在于系统后台,就可以通过安装在门口的感知型摄像机抓拍每个进出小区人员的人脸特征,并立刻送到后台去比对,一旦发现某个人员的外貌特征与目标嫌疑人比较相似,系统就会马上报警,公安人员即可指挥调度实施现场抓捕。当然,要结合行业需求实现这三大类应用,需要企业深入研究行业用户的需求,对行业需求的精准把握是大数据应用的关键。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04在数字化转型进入深水区的今天,企业对数据的依赖程度日益加深,而数据治理体系则是企业实现数据规范化、高质量化、价值化的核心 ...
2026-03-04在深度学习,尤其是卷积神经网络(CNN)的实操中,转置卷积(Transposed Convolution)是一个高频应用的操作——它核心用于实现 ...
2026-03-03在日常办公、数据分析、金融理财、科研统计等场景中,我们经常需要计算“平均值”来概括一组数据的整体水平——比如计算月度平均 ...
2026-03-03在数字化转型的浪潮中,数据已成为企业最核心的战略资产,而数据治理则是激活这份资产价值的前提——没有规范、高质量的数据治理 ...
2026-03-03在Excel办公中,数据透视表是汇总、分析繁杂数据的核心工具,我们常常通过它快速得到销售额汇总、人员统计、业绩分析等关键结果 ...
2026-03-02在日常办公和数据分析中,我们常常需要探究两个或多个数据之间的关联关系——比如销售额与广告投入是否正相关、员工出勤率与绩效 ...
2026-03-02在数字化运营中,时间序列数据是CDA(Certified Data Analyst)数据分析师最常接触的数据类型之一——每日的营收、每小时的用户 ...
2026-03-02在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27在数字化时代,企业积累的海量数据如同散落的珍珠,若缺乏有效的梳理与分类,终将难以发挥实际价值。CDA(Certified Data Analys ...
2026-02-27在问卷调研中,我们常遇到这样的场景:针对同一批调查对象,在不同时间点(如干预前、干预后、随访期)发放相同或相似的问卷,收 ...
2026-02-26在销售管理的实操场景中,“销售机会”是核心抓手—— 从潜在客户接触到最终成交,每一个环节都藏着业绩增长的关键,也暗藏着客 ...
2026-02-26在CDA数据分析师的日常工作中,数据提取、整理、加工是所有分析工作的起点,而“创建表”与“创建视图”,则是数据库操作中最基 ...
2026-02-26在机器学习分析、数据决策的全流程中,“数据质量决定分析价值”早已成为行业共识—— 正如我们此前在运用机器学习进行分析时强 ...
2026-02-25在数字化时代,数据已成为企业决策、行业升级的核心资产,但海量杂乱的原始数据本身不具备价值—— 只有通过科学的分析方法,挖 ...
2026-02-25