
大数据 及若干问题的讨论_数据分析师考试
1、大数据的发展趋势。Gartner2014年发布了技术成熟度曲线,把一项技术的发展分为:创新的萌芽期,膨胀期望的高峰期,幻灭的低谷期,光阴的爬升期,和生产率的稳定期五个阶段。大数据技术经历了2011年的萌芽期,2012、2013的膨胀期,现在慢慢进入幻灭的低谷期,实际上,2014年大数据炒作的热度开始降温,大数据还有5到10年才会达到稳定期,这样一个判断。
2、大数据、大数据技术的认识误区。数据量大是不是就可以成为大数据呢?这里面有一些认识上的误区。宁波的某个区,花2亿元,在全区装三千多个高清摄像头,每天产生5PB数据,是不是就是大数据?网上也流传过一些段子,比如说卖包子的开店,通过分析人流量进行选址,也叫大数据分析。我们在调研的过程中发现,有些企业把历史的交易数据、财务数据等进行整合、统计分析,然后得出一些曲线图,统计图等。传统数据的统计分析,我们称为具备数据思维。这很好,但还远远不够。一般认为大数据有4个特点,4V,即数据量大、数据类型繁多、高速处理、价值密度低。但我们认为,大数据,一定要有不同类型数据的融合,比如卫生局的数据和人口方面、地理数据等的融合,可以有新的发现,产生新的价值。这才是大数据真正奇妙的地方所在。宁波某区区长直言大数据就是烧钱,没有钱是玩不起的。显然这种认识也是片面的,如果大数据技术只是盲目上设备、大搞建设,却不知价值所在,当然会入不敷出。但大数据真正的价值除了服务民生,还要应用于产业,从而产生经济价值、带来经济效益。
3、数据的开放和共享问题。这里面既包括政府数据,也有企业数据。原来我以为,信息孤岛现象主要存在于政府部门,因为大家各自为政,同时受IBM白皮书的影响(将智慧城市分为:智慧交通、智慧医疗、智慧环保等7个智慧板块),国内各级政府一窝蜂的上项目,因为没有统一的规划和协调,上一个项目便成为一个信息孤岛。但调研过后我们发现,其实政府部门的数据做到内部的互联互通、融合、共享还是比较容易的,比如卫生局可以来协调所有医院的数据,因为有行政的手段可以干预和协调,比如宁波卫生局的大数据应用就是一个很好的案例。而企业的数据共享就比较难,比如腾讯很难把自己的数据共享给阿里,或者中移动。对于一些企业来说,包括中小企业,数据就是命脉,自己可能还没有好好利用,一般是不愿意公开给别人的。所以这个互联互通是很难的。因此在企业界,更容易出现信息孤岛现象。
我们的建议
针对以上两个问题,我们有两点建议:政府数据共享,目前证明,内部开放和共享是可能的,但对企业和公众开放还没有很好的案例。因为也牵扯到涉密的问题。国内某市长就曾直言,我把数据公开了,如果有人挖掘出国家机密,算谁的责任?数据开放没有依据和标准。所以我们的建议是,将数据进行分级,包括密级和轻重缓急,哪些数据可以马上开放、哪些可以逐步开放、哪些不能开放。当然,开放不等于公开,有些数据可以完全公开使用,有些经过申请和审批可以使用等等。
企业数据共享,我们认为,数据既然有价值,就可以作为资产,可以设立数据银行进行交易,企业可以对自己的数据进行存取,租用等。形成数据产业价值链,让企业的数据可以实现增值和共享,这样来方便大家把数据贡献出来,进行流动,融合以及产生更大的价值,当然具体商业模式可能还需要探索,还要解决数据的所有权问题等。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
DBeaver 实战:实现两个库表结构同步的高效路径 在数据库管理与开发工作中,保持不同环境(如开发库与生产库、主库与从库)的表 ...
2025-08-08t 检验与卡方检验:数据分析中的两大统计利器 在数据分析领域,统计检验是验证假设、挖掘数据规律的重要手段。其中,t 检验和卡 ...
2025-08-08CDA 数据分析师:解锁数据价值的专业力量 在当今这个数据爆炸的时代,数据已成为像石油一样珍贵的战略资源。而 CDA 数据分析师, ...
2025-08-08人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-08-07SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07CDA 数据分析师考试全解析 在当今数字化时代,数据已成为企业发展的核心驱动力,数据分析师这一职业也愈发受到重视。CDA 数据分 ...
2025-08-07大数据时代的隐患:繁荣背后的隐忧 当我们在电商平台浏览商品时,系统总能 “精准” 推送心仪的物品;当我们刷短视频时,算法 ...
2025-08-07解析 F 边界检验:协整分析中的实用工具 在计量经济学的时间序列分析中,判断变量之间是否存在长期稳定的均衡关系(即协整关系) ...
2025-08-07CDA 数据分析师报考条件详解:迈向专业认证的指南 在数据分析行业蓬勃发展的当下,CDA 数据分析师认证成为众多从业者提升专业 ...
2025-08-07通过 COX 回归模型诊断异常值 一、COX 回归模型概述 COX 回归模型,又称比例风险回归模型,是一种用于生存分析的统计方法。它能 ...
2025-08-07评判两组数据与初始数据准确值的方法 在数据分析与研究中,我们常常会面临这样的情况:需要对通过不同方法、不同过程得到的两组 ...
2025-08-07CDA 数据分析师行业标准:构建数据人才的能力坐标系 在数据驱动决策成为企业核心竞争力的时代,CDA(数据分析师)行业标准作为 ...
2025-08-07反向传播神经网络:突破传统算法瓶颈的革命性力量 在人工智能发展的历史长河中,传统算法曾长期主导着数据处理与模式识别领域 ...
2025-08-07MySQL 统计连续每天数据:从业务需求到技术实现 在数据分析场景中,连续日期的数据统计是衡量业务连续性的重要手段 —— 无论是 ...
2025-08-07抖音数据分析师:驱动平台增长的幕后推手 在抖音这个日活用户数以亿计的超级平台上,每一次用户的滑动、点赞、评论,每一条 ...
2025-08-07基于 SPSS 的中介效应分析结果解读:揭示变量间的隐性关联 在社会科学与自然科学研究中,变量之间的关系往往并非简单的直接作用 ...
2025-08-07