京公网安备 11010802034615号
经营许可证编号:京B2-20210330
如何才能将大数据真正应用起来
在这个信息爆炸的时代,每天都有大量各种各样的信息数据产生,怎么发掘这些海量数据的价值成为所有人关注的重点。因此,上至政府部门,下至平头百姓,各行各业对大数据的讨论越来越激烈,大家都在探寻大数据的奥妙和价值。
大数据说起来比较玄乎,实际上已经慢慢地渗透到我们生活的方方面面。以现在越来越普及的网络购物为例,我们在某购物网站中搜索了某些商品,再次登录该网站,甚至是其他的网站,往往就会看到系统自动推荐的与上次搜索相关的商品信息。这就是购物网站应用大数据分析,摸清了用户的消费习惯,精准推送用户可能感兴趣的产品,以更有效地促进用户消费。这是个人购物行为,再更进一步,每年各大购物网站都会发布一些购物指南,得出了一些非常有趣的结论,比如哪个地区男士为女士购买的商品最多;哪个年龄段的网络消费能力更强;同类产品,哪个品牌在某个区域的销量更好等等,这些都是通过大数据分析得到。目前,政府、医疗、互联网等等行业都已经开始了大数据应用。
大数据与安防
虽然大数据在不少行业都已经开始得到应用,并取得了非常不错的效果,但是就安防行业来说,大数据应用之路才刚刚开启。在安防领域,主要的数据来源是视频,与其他行业结构化的数据不一样,视频是一种非结构化的数据,不能直接被计算机进行处理或分析。因此,安防要进行大数据应用,首先就要采用智能分析技术将非结构化的视频数据转换成计算机能够识别和处理的结构化信息,即将视频中包含的各种信息(主要是运动目标及其特征)提取出来转成文字描述,这样才能通过计算机来对这些视频进行搜索、比对、分析等。但是,早期安防行业并没有有效的技术手段来展开这项工作。
智能分析技术其实很早就已经应用于安防行业,只不过受限于智能分析算法本身以及摄像机的硬件性能,早期主要是通过智能分析服务器来实现视频图像的智能识别和分析,但这种方式存在一个致命的缺陷——成本过高。一台刀片式服务器价格在六七万左右,而一台服务器只能识别七、八路1080P高清监控录像。以一个中等规模的城市为例,整体建设可能有十来万个监控点,即使只做2000路智能分析,也要两百多台服务器,这个成本是相当可观的。除了服务器的设备成本之外,还有服务器的能耗、所占场地、数据中心的网络设备、后期维护等成本,这些成本不比购买服务器的成本低。正是服务器这种智能分析模式因为成本过高无法规模化应用,所以视频信息无法大规模转换成结构化的数据,安防大数据也就一直无法落到实地。
随着智能分析算法的逐步成熟,以及摄像机硬件性能的不断提升,越来越多企业开始考虑将更多智能识别算法前置到摄像机中,毕竟摄像机本身的成本增加是可以预见的。在安防业内,以科达为代表的感知型摄像机这类智能摄像机的推出,比较经济有效地解决了视频数据结构化的问题,为安防大数据应用打下了基础。
除了视频数据的非结构化外,与其他行业相比,安防行业的大数据还有一些典型特征,这些特征对存储系统提出了更高的要求。比如视频的数据量特别大,且还在不断增多,就要求存储系统能够很方便地扩容;视频的价值密度低,且是实时的,连续的,稍纵即逝的,不容丢失,就要求存储的可靠性要高;一个PB级的存储系统硬盘就有几千甚至几万块,这么多硬盘可能每天都会有损坏,如果一损坏就要更换会非常麻烦,这就对存储提出了可维护性的要求;既然是大数据视频,说明会有各种各样的用户会去访问这些视频数据,所以对并发访问会有更高要求等等。要满足上述要求,传统的存储方式已经无能为力,只有云存储才能支撑。
一段视频经过智能摄像机的分析提取以后,形成了原始视频、视频里面每个运动目标的图片以及每个运动目标的语义文字描述三类数据,其中图片和视频是非结构化数据,一般存于云存储系统中,而语义的文字描述这类结构化数据存在于后端的大数据数据库中,每一条文字的描述对应相应的目标图片和视频。在完成了视频的结构化处理,以及三类数据的存储之后,应用就是接下来的关键,否则存储的数据也没有价值。
尽管在不同的垂直行业,安防大数据的应用会有一定差异,但从目前应用最为成熟的公安、交通等行业来看,大数据应用大致可以归结为检索、分析研判、实时布控和调度三大类。
第一类检索,在实现视频结构化之前,查找、检索视频只能靠人,而将视频结构化之后,利用后端的大数据检索系统,就能很方便地搜出相对应的文字、图片以及视频。比如要查找某一时间段经过某个路段一个穿蓝色衣服的可疑人员,用户只需要输入“蓝色衣服”,就能找出该时间段内所有穿蓝色衣服的人的图片,点击图片就可以获取这个人经过这个路段的视频。
第二类分析研判,比如通过车辆的多点碰撞,看是否有哪辆车在几个路口都出现过,从而帮助公安发现嫌疑车辆。
第三类是实时布控和调度,比如,公安知道一个嫌疑人住在某个小区,并且嫌疑人照片已经存在于系统后台,就可以通过安装在门口的感知型摄像机抓拍每个进出小区人员的人脸特征,并立刻送到后台去比对,一旦发现某个人员的外貌特征与目标嫌疑人比较相似,系统就会马上报警,公安人员即可指挥调度实施现场抓捕。当然,要结合行业需求实现这三大类应用,需要企业深入研究行业用户的需求,对行业需求的精准把握是大数据应用的关键。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18小陈是某电商平台的数据分析师。老板交给他一个任务:“我们平台的注册用户已经突破1000万了,想了解一下用户的平均月消费金额。 ...
2026-05-18【专访摘要】本次CDA持证专访邀请到拥有丰富物流供应链数据分析经验的赖尧,他结合自身在京东、华莱士、兰格赛等企业的从业经历 ...
2026-05-15在数字化时代,企业的每一次业务优化、每一项技术迭代,都需要回答一个核心问题:这个动作到底能带来多少价值?是提升了用户转化 ...
2026-05-15在数据仓库建设中,事实表与维度表是两大核心组件,二者相互关联、缺一不可,共同构成数据仓库的基础架构。事实表聚焦“发生了什 ...
2026-05-15 很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问 ...
2026-05-15【核心关键词】互联网、机会、运营、关键词、账户、数字化、后台、客户、成本、网络、数据分析、底层逻辑、市场推广、数据反馈 ...
2026-05-14