
大数据的机遇与挑战
作为一个数据科学家,我认为:第一,政府和企业只要扎扎实实打好基础,就能从大数据技术上获益。第二,大数据技术目前是一个正在从应用中逐渐走向成熟的技术,挑战仍然很多。
大数据是很多工作的基本“标配”
什么是大数据?什么是数据?什么是资料?资料就是生产过程、管理过程,乃至经济、社会、生活过程的记忆。那些记忆可能表现在一个文件、一段演讲、一段文字等等。资料放在计算机上就叫数据。真正的大数据是指大而复杂的资料集,这些复杂性包括了海量性、时变性、异构性、分布性等,是我们从互联网的数据能够观察到的特征。只要数据量超过临界量,就叫大数据,反之则不叫大数据。因而讲大数据涉及两个概念:第一,大和小是相对概念;第二,相对的特定问题而言,不同的决策问题要求的数据不一样。
有人认为现在是大数据时代,大数据可以解释任何事情,其实是不正确的。当然,不重视大数据同样不正确。现在都说大数据是基本的生产资料,大数据是基本的生产力,因而才说大数据是经济社会的基本生产资源。大数据离不开互联网,近几年互联网的发展走向是从复杂的信息传递到消费互联,再到生产互联,也就是物联网,再到智慧互联。在这个走向中信息技术向互联网产生以后,要与其他任何领域深度整合,这就是今天谈论信息工业化、谈论大数据的主要原因。
目前新技术很多,真正产生效益和作用的是所有技术的综合运用。所有技术是互补的,都是从不同的层面讲问题。互联网和云计算是基础设施,物联网讲的是交互方式,人工智能讲的是应用模式。大数据讲的是信息技术,是人和人、人和机器、机器和机器交互的内容特征。大数据是最底层的信息技术,是基本标配。
大数据可以带来超凡价值
对于大数据如何去运用,我想说五句话。
第一,明确目标是前提。这是推出大数据产业最重要的一步。只有真正解决每个地区、每个政府、每个企业不同的问题,大数据才有用。
第二,拥有数据是基础。大数据产业就是以现代技术设施为基础,以数据为生产要素,以数据的价值挖掘为创新活动的产业叫大数据产业。因此,没有数据就谈不上大数据产业。
第三,计算平台是支撑。换句话说,没有一定的计算架构和计算平台,计算不了。它是支撑作用,但做企业的人不必过分强化,也不必过分低估。
第四,分析技术是核心。这是当今较少提到的一个主题。我非常担心在整个大数据的链条中,有些链条做得过分粗壮,有的链条过分纤弱,也就是产业链布局不均衡。如果过分膨胀,将会产生新的产能过剩。
第五,产生效益是根本。数据是基础,平台是支撑,技术是核心,盈利是王道。
为什么大数据可以带来超凡价值?有三条原理:第一,量变到质变的原理。大数据之所以有用,是因为数据积攒到了可以质变,通过数据就可以知道背后的故事。第二,分析出价值原理。如果存储不分析,无疑是只买米不做饭,产生不了实际效益。所以,要分析,要挖掘。第三,跨界关联原理。
这个过程中有很多观念要改变:第一,数据是资产;第二,用户是资源;第三,服务即感知。大数据突飞猛进地发展,能够解决相当多的问题,但千万不要以为大数据技术已经成熟了。挑战仍然存在,主要是分析基础被破坏,计算技术待革新,真伪判定需要重建,对新技术的盲目所引起的盲从。总体来说,虽然挑战很多,但是仍需集中力量攻克,大数据的发展才能有大的突破。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Python HTTP 请求工具对比:urllib.request 与 requests 的核心差异与选择指南 在 Python 处理 HTTP 请求(如接口调用、数据爬取 ...
2025-09-12解决 pd.read_csv 读取长浮点数据的科学计数法问题 为帮助 Python 数据从业者解决pd.read_csv读取长浮点数据时的科学计数法问题 ...
2025-09-12CDA 数据分析师:业务数据分析步骤的落地者与价值优化者 业务数据分析是企业解决日常运营问题、提升执行效率的核心手段,其价值 ...
2025-09-12用 SQL 验证业务逻辑:从规则拆解到数据把关的实战指南 在业务系统落地过程中,“业务逻辑” 是连接 “需求设计” 与 “用户体验 ...
2025-09-11塔吉特百货孕妇营销案例:数据驱动下的精准零售革命与启示 在零售行业 “流量红利见顶” 的当下,精准营销成为企业突围的核心方 ...
2025-09-11CDA 数据分析师与战略 / 业务数据分析:概念辨析与协同价值 在数据驱动决策的体系中,“战略数据分析”“业务数据分析” 是企业 ...
2025-09-11Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04