京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据or安全 企业风险管控的变革之始
如今,企业中用来检测高级安全威胁和支持业务发展的数据量呈指数级增长,与此同时企业安全管理人员也经常被要求要整合不同来源和连接点的数据,并对可能出现的网络攻击或数据泄露进行检测。这种依赖于手动操作来梳理庞大的数据是导致关键问题无法得到及时处理的主要原因之一,这也解释了为何“大数据的安全”常被认为是个烫手山芋,尽管它在企业安全中低调地扮演着重要角色。
大数据安全领域的噱头不少,虽然它通常被应用在刺激企业营收的文案中,但是大数据代表了安全从业者需要面对巨大的挑战。一些规则犹如雨后春笋般出现,如PCI DSS 3.0,NIST,FISMA等。安全状态评估更为频繁,而不断增加的网络攻击也使安全问题更棘手。在Gartner Neil MacDonald 2012年3月的文章《信息安全正成为大数据分析难题》中,作者写道:“到2016年,企业信息安全组织分析的数据量每年都将翻倍。届时,40%的企业都会主动分析至少10T的数据用于搜集信息安全情报,较之2011年,涨幅将近3%。”
为确保实现合适的聚合,许多组织都依赖多个基于大型数据存储的工具,(例如,欺诈和数据丢失防护、漏洞管理、SIEM)以生成必要的安全数据。这只会增加要分析,标准化和优先的数据服务的数量,速度和复杂度。这和自适应验证不同,自适应验证被用于支付行业里防御诈骗的行为模式自动分析,而许多常用的安全工具都缺乏自助分析的能力。要被分析的安全数据规模也变得太庞大太复杂,从而难以掌控。现在要拼凑一幅可行的蓝图需要几个月甚至几年的时间。
不幸的是,依赖手动操作来梳理这么庞大的数据导致重要事情无法得到及时处理的主要原因之一。根据2013年 Verizon 数据泄露调查报告统计,69%的数据泄露都是由第三方组织发现的,而并非通过内部资源发现。
其实,安全工作的最终目的是减少攻击者可以利用的软件或网络配置漏洞的缺陷。大数据集有助于把指定的行为放到语境中,但是还存在一些要克服的技术挑战。在大型数据存储中运行的传统安全工具也会把业务临界纳入考虑之中,以便处理大型数据集时做优先纠正的操作。
这就引出了一个问题,企业如何才能在不雇佣大量新员工的前提下利用大数据安全呢?
虽然安全产品的监控产生了大数据,但是根本上来说这只是手段而不是目的。最终,信息安全的决策的制定应该是源自于从数据中得出优先可操作的洞察力。为了实现这个目的,需要大量的安全数据和企业的业务关键性的风险或组织关联起来。如果没有基于风险管理的方式,企业可能把有价值的IT资源浪费到解决无关紧要的漏洞上。而且,需要过滤庞大的安全数据来判断与特定持股人的责任相关的信息。在大数据利用方面,没有谁的需求和目的是完全相同的。
为了应对大数据的安全性,实现可持续的诊断,进步组织正在利用大数据风险管理系统将很多用手动操作的劳动密集型任务转为自动操作。这些系统互相连接数据库安全和IT工具,对其产生的数据进行持续关联和评估,从而采取预防式的主动防护措施。反过来,这样又让企业可以实现一个闭合式,基于风险的自动纠正进程。这样可以节约大量的时间和成本,提高准确度,缩短修复周期,而且能提升整体运行效率。
大数据风险管理系统使企业能够把威胁和漏洞变得可视化和可操作,同时也让他们可以在安全规则被破坏前,优先解决高风险的安全问题。最终,将网络攻击的影响降到最低。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 一、数据分析四大思维 1. 对比思维:没有对比就没有分析 核心观点:单独一个数字没有意义,有 ...
2026-10-05Kimball 是方法,星型模型是它产出的形状。 很多人把"Kimball vs 星型模型"当成一道选择题——这本身就是个误会:Kimball 是动词 ...
2026-10-05写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23