京公网安备 11010802034615号
经营许可证编号:京B2-20210330
五、大数据驱动的侦查模式运行机制
大数据驱动的侦查模式运行机制主要有三个相互关联机制组成,即犯罪监控机制、犯罪侦破机制、犯罪预测机制。
犯罪监控机制。监控(surveillance)的本意是密切注视、观察或监视所要监控的对象,包括人、事、物、场所等。在传统社会,监控是靠人的感官来完成的;而在现代社会中,监控依赖于各种各样的数据记录、存储设备以及分析、提取技术,是一种数据监视。而大数据监视是一种“全景敞式监视”[21]。但这种监视已经超越了边沁和福柯的概念,因为其不仅是空间上的全景敞式,也是时间上的全景敞式,是空间、时间、权力的立体交汇。
数据监控作为一种犯罪监控机制来说,要实现监控,必须要适时提取或捕捉到犯罪的相关信息。在依靠人工提取、分析信息的时代,大量数据不能被应用,处于沉睡状态,有关犯罪的信息不能得到及时提取。到了大数据时代,不仅数据量大了,更重要的是犯罪信息能够被适时抽取,大数据的监控价值得以真正实现。
根据提取或捕捉犯罪信息的时间,可以把大数据监控机制划分为两大机制:一是数据记录、存储以供分析、提取机制。这种机制实质是为犯罪侦破机制的数据做准备。二是实时报警机制。这需要三个步骤:问题识别和定义、模型建构、实时报警。问题识别和定义是指要对什么样的信息进行提取,数据分析要达到的目标是什么?并对要提取的信息和达到的目标进行数据化的界定。模型建构就是根据大数据和其要提取的信息、达到的目标构建数据模型。数据模型或者能够进行智能化搜索和比对,如苏州市公安局近期开发的人脸识别系统;或者能捕捉到异常的数据。最后是对搜索比对到的有价值的信息或异常数据进行可视化的报警。
犯罪侦破机制。犯罪侦破机制是指案件发生后,侦查机关为达到侦查破案的目的所采用的手段、方式和过程。大数据时代的犯罪侦破机制大体分为四个阶段:
数据准备。数据准备包括数据采集、清洗、转换和数据集成。数据采集既包括具体案件发生后现场勘查、现场访问所获得的数据,也包括准备的与案件相关的大平台数据,更重要的是按照相关性理念,向社会采集相关的各种数据,⑦如出租车运行轨迹数据、银行数据、公共场所非公安视频数据、电话数据、移动设备数据、私家庭院视频数据、个人手机随手拍数据、互联网数据等等。数据清洗是指清除数据噪声和与挖掘主题明显无关的数据。数据集成是将来自多个数据源、不同结构的相关数据组合在一起。数据转换就是对数据进行一定的格式转换,使其适应数据挖掘系统或挖掘软件的处理要求。
明确问题和确定分析思路。侦查过程是一个问题(比如是谁在什么时间用什么工具作案等一系列问题)求解过程。根据现有的数据比如现场勘查、现场访问等收集的信息以及采集到海量数据情况,明确侦查要求解的问题,并对问题具体化和数据化。然后根据明确的问题,确定具体分析思路。
数据挖掘。这个阶段主要是根据所编制的问题进行大数据分析。通常的分析方法有关联分析、序列模式分析、分类分析、聚类分析等等。所谓的“关联”是指两个或多个数据之间存在着一定的相关关系或规律。数据中的关联按照关联物的类型可以分为人员关联、行为关联、事件关联、物品关联和综合关联;按照关联方式可分为简单关联、时序关联和因果关联等。关联分析,是利用计算机技术、统计技术、数学模型等挖掘出隐藏在数据中的关联关系。比如某个具有一定特点的系列案件发生时,总有甲的手机信号存在,由此我们就可推断出甲可能与该系列案件有相关关系。链接分析是相关分析的一种类型,主要用于从确定的已知条件通过分析人与人之间,事与事之间、地点之间以及组织之间的相互联系去确定犯罪嫌疑人及其整个犯罪网络。这对于结伙犯罪、恐怖主义犯罪、洗钱、网络诈骗尤为有效。比如已知某个嫌疑人,可以通过电话链接、电邮链接、业务链接等等的分析,追踪到犯罪的关系网络,可以确定哪些人是这个关系网络的核心,从而确定关键人物[22]。再比如若已知某笔异常的资金交易,可以通过追踪其流向确定犯罪嫌疑人及其运作方式。序列模式分析与关联分析法相似,是一种挖掘出能反映数据间的前后关系的分析。如通过银行账号资金的流动前后分析、比较,发现异常账户,追踪犯罪嫌疑人的动向。分类分析和聚类分析是两个相反过程的分析方法。分类分析是按预先标准或记录对数据进行分类,并在此基础上对数据特征进行更为深入的描述。聚类分析是一种探索性的分析,是根据一定的规则,对未标定或未分类的数据进行合理的分类。分类和聚类在侦查中的应用,如对身体特征、作案方式等进行分类分析与聚类分析,也许能给侦查人员提供更多、更详细的信息,从而确定犯罪嫌疑人。
确定目标和验证阶段。通过大数据分析,可能会产生两种结果:一种是缩小了侦查范围,这当然还需要进一步线下查证,以确定犯罪嫌疑人。另一种是确定了犯罪嫌疑人,但这仍然需要线下查证。这是因为数据只是事实的镜像,其确定只是一种概率以及数据证明与法律证明体系的间隔,所以需要从现实关系上进一步查证,把数据确定转换为法律确定。
预测机制。研究证明,人类的行为93%是可以预测的,成为“已发生的未来”。犯罪预测机制是通过大数据和“幂律分布”分析,较为准确预报犯罪类型、犯罪时间、犯罪场所、犯罪趋势的手段、方式和过程。在美国的孟菲斯,犯罪预测系统“让当地的犯罪率下降了31%”[23]。大数据预测的一般路径是通过对过去犯罪规律的描述建立模型并对模型优化,然后将现有数据输入模型进而从其结果中预测未来。⑧大数据预测犯罪常用的分析工具是贝叶斯网络。贝叶斯网络是一种概率推理方法,它能从不完全、不精确和不确定的知识和信息中做出推理,可以处理不完整和带有噪声的数据集,从而解决了数据间不一致甚至相互独立的问题。
大数据引领现代警务的发展,但毋庸赘言大数据并不是完美无缺的。美国微软研究院首席研究员、麻省理工学院公民媒体中心客座教授凯特·克劳福德对大数据的效用提出了质疑,认为大数据中存在偏见和盲区[25]。我们认为,大数据仅仅是一种技术,再高端的技术也离不开人的驾驭。大数据不能排除人的经验、直觉在其中的作用。大数据驱动的侦查模式,是对传统侦查模式的超越,但其有效模式应是大数据、侦查直觉、经验的完美结合。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05