京公网安备 11010802034615号
经营许可证编号:京B2-20210330
安全真实考验大数据时代_数据分析师
在刚刚过去的2012年,“大数据”的概念在商业领域突然走红。但另一方面,大数据也引发了这样的担忧,商家在使用这些海量信息的同时会不会造成消费者信息泄露。
2012年12月28日,十一届全国人大常委会第三十次会议审议通过关于加强网络信息保护的决定草案。关于个人信息保护,决定草案明确了一个重要原则,就是国家保护能够识别公民个人身份和涉及公民个人隐私的电子信息。同时,草案还对个人信息收集者的义务作了多项规定。对于过去一年被人们热议的“大数据”而言,这个决定草案可谓正当时。
大数据的价值何在
在全球500强企业中,90%以上的重要投资与经营决策都取决于充分的数据分析支持。中国商业联合会数据分析专业委员会会长邹东生认为,大数据时刻影响到企业的整体运营链的管理,从前端的管理,到后端的供货商、物流等都受到深刻的变化和影响。
美国政府则在2012年3月29日宣布投资两亿美元拉动大数据相关产业发展,将“大数据战略”上升为国家意志。
中国商业联合会副会长刘建沪介绍说,随着互联网的快速发展,中国的电子商务企业纷纷组建了数据分析部门。大数据的市场有多大?中央财经大学中国经济管理研究院博士张永力说,国外大数据行业约有1000亿美元的市场,而且每年都以10%的速度在增长,增速是软件行业的两倍。
据悉,为迎接大数据的到来,2011年10月,工信部确认京沪深杭等5城市为“云计算中心”试点城市。而真正的问题或许不在于怎样建设“云计算中心”。国家信息中心常务副主任杜平直言不讳:“应对大数据的到来,需要不断建基础设施,但是建了干什么,有些数据需要存储,也有很多数据可能不需要储存。”
事实上,目前企业在还没有能力深度挖掘出数据的价值之前,存储大量的数据,进行大规模的投资建设,的确有“浪费”之嫌。
数据真实性与安全性考验
邹东生坦承,大数据行业尚处在跑马圈地阶段,行业乱象不可避免。他介绍说,虚假资质、服务不规范、质量控制不严格等是这个行业存在的主要问题。
在中国改革基金会国民经济研究所副所长王小鲁看来,这个行业的真正考验来自数据的真实性。王小鲁说,数据分析的基础首先应该是准确的基础数据,“打个比方,数据分析就像有米下锅做饭,米的质量如何,可能对做出来的饭有决定性的影响。”
邹东生介绍说,在采集、整理、存储、传输的过程,人为因素很多,可能会有一些所谓的“难看”的数据被丢弃。更有甚者,有些数据可能会在这个过程中被篡改。
除了搜集企业内部的数据容易存在失真问题,企业对外部数据的利用也是真伪难辨。邹东生指出,这些外部数据多是通过公开渠道或者商业渠道获得的数据,一方面是真伪难辨,另一方面是这些数据多是统计分析加工后的呈现,如果照搬,往往会造成误差。
随着大数据时代的到来,个人数据安全也一直备受社会关注,从密码泄露到涉嫌恶意收集用户隐私,数据安全问题挑战着相关行业的商业道德底线。邹东生坦言,“大数据”里肯定会涉及到用户信息,甚至是相对隐私的数据的分析问题。
从“大数据”到“大分析”
大数据存储技术的提升,造成整个社会数据开始以几何级数递增,但数据本身不能带来价值,它的真正价值在于对其精准的分析。正如中国商业联合会数据分析专业委员会数据中心主任赵兴峰所言,大数据时代,数据是企业未来发展的“金库”,“但是,如果企业只是简单存储数据,而不是分析数据,尽快挖掘‘金库’里的‘黄金’,它仍然可能死在半路上。”
从“大数据”到“大分析”,赵兴峰认为,除了要避免盲目建设,国内的企业还要避免这样一个误区,就是把大量资金投入到可见的计算机硬件和软件上,而往往不愿意在“人”身上做投资,“现在人才市场上能够胜任数据深度分析和挖掘的人才都是凤毛麟角,即使能够找到,也是‘昂贵’的,可能无法留住。所以企业需要着重培养这方面的人才。”
而实现从“大数据”到“大分析”的转变,数据的真实性是前提,数据的安全性是发展命脉。如何保证数据的真实性?王小鲁认为,需要充分利用分析者的智慧去质疑,透过现象看本质。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在统计学分析、实验研究、业务数据复盘过程中,单因素方差分析是检验自变量对因变量是否存在显著影响的核心方法。其中,两个水平 ...
2026-05-26【核心关键词】算法、客户、大数据、互联网、调优、建模、模型优化、机器学习、评分卡模型、模型开发、智能风控、业务场景、数 ...
2026-05-26 很多数据分析师写过无数个 SELECT,但当被问到“新建一张表,该如何定义字段类型来保证数据质量”“创建视图和存储物理表有 ...
2026-05-26在数据清洗、统计分析与数据质量检测工作中,箱型图(又称箱线图、Box Plot)是最直观、最高效的可视化分析工具之一。相较于柱状 ...
2026-05-25在大数据分析、数据清洗、质量管控、风险监测等领域,异常数据识别是保障数据质量、确保分析结论精准、规避业务决策失误的核心基 ...
2026-05-25 很多数据分析师精通Excel函数和透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么关系 ...
2026-05-25数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18