
安全真实考验大数据时代_数据分析师
在刚刚过去的2012年,“大数据”的概念在商业领域突然走红。但另一方面,大数据也引发了这样的担忧,商家在使用这些海量信息的同时会不会造成消费者信息泄露。
2012年12月28日,十一届全国人大常委会第三十次会议审议通过关于加强网络信息保护的决定草案。关于个人信息保护,决定草案明确了一个重要原则,就是国家保护能够识别公民个人身份和涉及公民个人隐私的电子信息。同时,草案还对个人信息收集者的义务作了多项规定。对于过去一年被人们热议的“大数据”而言,这个决定草案可谓正当时。
大数据的价值何在
在全球500强企业中,90%以上的重要投资与经营决策都取决于充分的数据分析支持。中国商业联合会数据分析专业委员会会长邹东生认为,大数据时刻影响到企业的整体运营链的管理,从前端的管理,到后端的供货商、物流等都受到深刻的变化和影响。
美国政府则在2012年3月29日宣布投资两亿美元拉动大数据相关产业发展,将“大数据战略”上升为国家意志。
中国商业联合会副会长刘建沪介绍说,随着互联网的快速发展,中国的电子商务企业纷纷组建了数据分析部门。大数据的市场有多大?中央财经大学中国经济管理研究院博士张永力说,国外大数据行业约有1000亿美元的市场,而且每年都以10%的速度在增长,增速是软件行业的两倍。
据悉,为迎接大数据的到来,2011年10月,工信部确认京沪深杭等5城市为“云计算中心”试点城市。而真正的问题或许不在于怎样建设“云计算中心”。国家信息中心常务副主任杜平直言不讳:“应对大数据的到来,需要不断建基础设施,但是建了干什么,有些数据需要存储,也有很多数据可能不需要储存。”
事实上,目前企业在还没有能力深度挖掘出数据的价值之前,存储大量的数据,进行大规模的投资建设,的确有“浪费”之嫌。
数据真实性与安全性考验
邹东生坦承,大数据行业尚处在跑马圈地阶段,行业乱象不可避免。他介绍说,虚假资质、服务不规范、质量控制不严格等是这个行业存在的主要问题。
在中国改革基金会国民经济研究所副所长王小鲁看来,这个行业的真正考验来自数据的真实性。王小鲁说,数据分析的基础首先应该是准确的基础数据,“打个比方,数据分析就像有米下锅做饭,米的质量如何,可能对做出来的饭有决定性的影响。”
邹东生介绍说,在采集、整理、存储、传输的过程,人为因素很多,可能会有一些所谓的“难看”的数据被丢弃。更有甚者,有些数据可能会在这个过程中被篡改。
除了搜集企业内部的数据容易存在失真问题,企业对外部数据的利用也是真伪难辨。邹东生指出,这些外部数据多是通过公开渠道或者商业渠道获得的数据,一方面是真伪难辨,另一方面是这些数据多是统计分析加工后的呈现,如果照搬,往往会造成误差。
随着大数据时代的到来,个人数据安全也一直备受社会关注,从密码泄露到涉嫌恶意收集用户隐私,数据安全问题挑战着相关行业的商业道德底线。邹东生坦言,“大数据”里肯定会涉及到用户信息,甚至是相对隐私的数据的分析问题。
从“大数据”到“大分析”
大数据存储技术的提升,造成整个社会数据开始以几何级数递增,但数据本身不能带来价值,它的真正价值在于对其精准的分析。正如中国商业联合会数据分析专业委员会数据中心主任赵兴峰所言,大数据时代,数据是企业未来发展的“金库”,“但是,如果企业只是简单存储数据,而不是分析数据,尽快挖掘‘金库’里的‘黄金’,它仍然可能死在半路上。”
从“大数据”到“大分析”,赵兴峰认为,除了要避免盲目建设,国内的企业还要避免这样一个误区,就是把大量资金投入到可见的计算机硬件和软件上,而往往不愿意在“人”身上做投资,“现在人才市场上能够胜任数据深度分析和挖掘的人才都是凤毛麟角,即使能够找到,也是‘昂贵’的,可能无法留住。所以企业需要着重培养这方面的人才。”
而实现从“大数据”到“大分析”的转变,数据的真实性是前提,数据的安全性是发展命脉。如何保证数据的真实性?王小鲁认为,需要充分利用分析者的智慧去质疑,透过现象看本质。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
前台流量与后台流量:数据链路中的双重镜像 在商业数据分析体系中,流量数据是洞察用户行为与系统效能的核心依据。前台流量与 ...
2025-08-13商业数据分析体系构建与 CDA 数据分析师的协同赋能 在企业数字化转型的浪潮中,商业数据分析已从 “可选工具” 升级为 “核 ...
2025-08-13解析 CDA 数据分析师:数据时代的价值挖掘者 在数字经济高速发展的今天,数据已成为企业核心资产,而将数据转化为商业价值的 ...
2025-08-13解析 response.text 与 response.content 的核心区别 在网络数据请求与处理的场景中,开发者经常需要从服务器返回的响应中提取数 ...
2025-08-12MySQL 统计连续每天数据:从业务需求到技术实现 在数据分析场景中,连续日期的数据统计是衡量业务连续性的重要手段 —— 无论是 ...
2025-08-12PyTorch 中 Shuffle 机制:数据打乱的艺术与实践 在深度学习模型训练过程中,数据的呈现顺序往往对模型性能有着微妙却关键的影响 ...
2025-08-12Pandas 多列条件筛选:从基础语法到实战应用 在数据分析工作中,基于多列条件筛选数据是高频需求。无论是提取满足特定业务规则的 ...
2025-08-12人工智能重塑 CDA 数据分析领域:从工具革新到能力重构 在数字经济浪潮与人工智能技术共振的 2025 年,数据分析行业正经历着前所 ...
2025-08-12游戏流水衰退率:计算方法与实践意义 在游戏行业中,流水(即游戏收入)是衡量一款游戏商业表现的核心指标之一。而游戏流水衰退 ...
2025-08-12CDA 一级:数据分析入门的基石 在当今数据驱动的时代,数据分析能力已成为职场中的一项重要技能。CDA(Certified Data Anal ...
2025-08-12破解游戏用户流失困局:从数据洞察到留存策略 在游戏行业竞争白热化的当下,用户流失率已成为衡量产品健康度的核心指标。一款游 ...
2025-08-11数据时代的黄金入场券:CDA 认证解锁职业新蓝海 一、万亿级市场需求下的数据分析人才缺口 在数字化转型浪潮中,数据已成为企业核 ...
2025-08-11DBeaver 实战:实现两个库表结构同步的高效路径 在数据库管理与开发工作中,保持不同环境(如开发库与生产库、主库与从库)的表 ...
2025-08-08t 检验与卡方检验:数据分析中的两大统计利器 在数据分析领域,统计检验是验证假设、挖掘数据规律的重要手段。其中,t 检验和卡 ...
2025-08-08CDA 数据分析师:解锁数据价值的专业力量 在当今这个数据爆炸的时代,数据已成为像石油一样珍贵的战略资源。而 CDA 数据分析师, ...
2025-08-08SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07