京公网安备 11010802034615号
经营许可证编号:京B2-20210330
五、大数据驱动的侦查模式运行机制
大数据驱动的侦查模式运行机制主要有三个相互关联机制组成,即犯罪监控机制、犯罪侦破机制、犯罪预测机制。
犯罪监控机制。监控(surveillance)的本意是密切注视、观察或监视所要监控的对象,包括人、事、物、场所等。在传统社会,监控是靠人的感官来完成的;而在现代社会中,监控依赖于各种各样的数据记录、存储设备以及分析、提取技术,是一种数据监视。而大数据监视是一种“全景敞式监视”[21]。但这种监视已经超越了边沁和福柯的概念,因为其不仅是空间上的全景敞式,也是时间上的全景敞式,是空间、时间、权力的立体交汇。
数据监控作为一种犯罪监控机制来说,要实现监控,必须要适时提取或捕捉到犯罪的相关信息。在依靠人工提取、分析信息的时代,大量数据不能被应用,处于沉睡状态,有关犯罪的信息不能得到及时提取。到了大数据时代,不仅数据量大了,更重要的是犯罪信息能够被适时抽取,大数据的监控价值得以真正实现。
根据提取或捕捉犯罪信息的时间,可以把大数据监控机制划分为两大机制:一是数据记录、存储以供分析、提取机制。这种机制实质是为犯罪侦破机制的数据做准备。二是实时报警机制。这需要三个步骤:问题识别和定义、模型建构、实时报警。问题识别和定义是指要对什么样的信息进行提取,数据分析要达到的目标是什么?并对要提取的信息和达到的目标进行数据化的界定。模型建构就是根据大数据和其要提取的信息、达到的目标构建数据模型。数据模型或者能够进行智能化搜索和比对,如苏州市公安局近期开发的人脸识别系统;或者能捕捉到异常的数据。最后是对搜索比对到的有价值的信息或异常数据进行可视化的报警。
犯罪侦破机制。犯罪侦破机制是指案件发生后,侦查机关为达到侦查破案的目的所采用的手段、方式和过程。大数据时代的犯罪侦破机制大体分为四个阶段:
数据准备。数据准备包括数据采集、清洗、转换和数据集成。数据采集既包括具体案件发生后现场勘查、现场访问所获得的数据,也包括准备的与案件相关的大平台数据,更重要的是按照相关性理念,向社会采集相关的各种数据,⑦如出租车运行轨迹数据、银行数据、公共场所非公安视频数据、电话数据、移动设备数据、私家庭院视频数据、个人手机随手拍数据、互联网数据等等。数据清洗是指清除数据噪声和与挖掘主题明显无关的数据。数据集成是将来自多个数据源、不同结构的相关数据组合在一起。数据转换就是对数据进行一定的格式转换,使其适应数据挖掘系统或挖掘软件的处理要求。
明确问题和确定分析思路。侦查过程是一个问题(比如是谁在什么时间用什么工具作案等一系列问题)求解过程。根据现有的数据比如现场勘查、现场访问等收集的信息以及采集到海量数据情况,明确侦查要求解的问题,并对问题具体化和数据化。然后根据明确的问题,确定具体分析思路。
数据挖掘。这个阶段主要是根据所编制的问题进行大数据分析。通常的分析方法有关联分析、序列模式分析、分类分析、聚类分析等等。所谓的“关联”是指两个或多个数据之间存在着一定的相关关系或规律。数据中的关联按照关联物的类型可以分为人员关联、行为关联、事件关联、物品关联和综合关联;按照关联方式可分为简单关联、时序关联和因果关联等。关联分析,是利用计算机技术、统计技术、数学模型等挖掘出隐藏在数据中的关联关系。比如某个具有一定特点的系列案件发生时,总有甲的手机信号存在,由此我们就可推断出甲可能与该系列案件有相关关系。链接分析是相关分析的一种类型,主要用于从确定的已知条件通过分析人与人之间,事与事之间、地点之间以及组织之间的相互联系去确定犯罪嫌疑人及其整个犯罪网络。这对于结伙犯罪、恐怖主义犯罪、洗钱、网络诈骗尤为有效。比如已知某个嫌疑人,可以通过电话链接、电邮链接、业务链接等等的分析,追踪到犯罪的关系网络,可以确定哪些人是这个关系网络的核心,从而确定关键人物[22]。再比如若已知某笔异常的资金交易,可以通过追踪其流向确定犯罪嫌疑人及其运作方式。序列模式分析与关联分析法相似,是一种挖掘出能反映数据间的前后关系的分析。如通过银行账号资金的流动前后分析、比较,发现异常账户,追踪犯罪嫌疑人的动向。分类分析和聚类分析是两个相反过程的分析方法。分类分析是按预先标准或记录对数据进行分类,并在此基础上对数据特征进行更为深入的描述。聚类分析是一种探索性的分析,是根据一定的规则,对未标定或未分类的数据进行合理的分类。分类和聚类在侦查中的应用,如对身体特征、作案方式等进行分类分析与聚类分析,也许能给侦查人员提供更多、更详细的信息,从而确定犯罪嫌疑人。
确定目标和验证阶段。通过大数据分析,可能会产生两种结果:一种是缩小了侦查范围,这当然还需要进一步线下查证,以确定犯罪嫌疑人。另一种是确定了犯罪嫌疑人,但这仍然需要线下查证。这是因为数据只是事实的镜像,其确定只是一种概率以及数据证明与法律证明体系的间隔,所以需要从现实关系上进一步查证,把数据确定转换为法律确定。
预测机制。研究证明,人类的行为93%是可以预测的,成为“已发生的未来”。犯罪预测机制是通过大数据和“幂律分布”分析,较为准确预报犯罪类型、犯罪时间、犯罪场所、犯罪趋势的手段、方式和过程。在美国的孟菲斯,犯罪预测系统“让当地的犯罪率下降了31%”[23]。大数据预测的一般路径是通过对过去犯罪规律的描述建立模型并对模型优化,然后将现有数据输入模型进而从其结果中预测未来。⑧大数据预测犯罪常用的分析工具是贝叶斯网络。贝叶斯网络是一种概率推理方法,它能从不完全、不精确和不确定的知识和信息中做出推理,可以处理不完整和带有噪声的数据集,从而解决了数据间不一致甚至相互独立的问题。
大数据引领现代警务的发展,但毋庸赘言大数据并不是完美无缺的。美国微软研究院首席研究员、麻省理工学院公民媒体中心客座教授凯特·克劳福德对大数据的效用提出了质疑,认为大数据中存在偏见和盲区[25]。我们认为,大数据仅仅是一种技术,再高端的技术也离不开人的驾驭。大数据不能排除人的经验、直觉在其中的作用。大数据驱动的侦查模式,是对传统侦查模式的超越,但其有效模式应是大数据、侦查直觉、经验的完美结合。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Excel数据分析中,数据透视表是汇总、整理海量数据的高效工具,而公式则是实现数据二次计算、逻辑判断的核心功能。实际操作中 ...
2026-04-30Excel透视图是数据分析中不可或缺的工具,它能将透视表中的数据快速可视化,帮助我们直观捕捉数据规律、呈现分析结果。但在实际 ...
2026-04-30 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-04-30在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22