
大数据与云计算的惊人相似之处
大数据强调非结构化数据的挖掘,云计算强调资源高效利用,一个面向业务应用,一个面向IT管理,不说风马不相及,但彼此交集并不多。
二者惊人相似之处并不在于内容,而在于其市场传播和导入过程,首先二者都是舶来品,其次在开始的时候,没有弄得明白它们是什么。
回想一下2~3年前,没有说得清楚云计算是什么?但有很多人会告诉你,云计算不是什么,不是虚拟化,不是绿色节能。大数据也是如此,很少有人说清楚4个V是什么?有的v连个准确的中文翻译都没有。
现在有很多告诉你,大数据不是数据大,大数据不是Hadoop,就是没有人愿意说大数据是什么?一句话,你说什么就是什么,可以说广义大数据、狭义大数据、机器大数据,也可以说行业大数据。
在云计算推广初期,从软件到硬件、从芯片到整机,从数据中心规划、设计到运维,人人都说自己是云计算,数据中心也被称为云计算数据中心。如今,类似事情恐要为大数据重演,服务器、存储、数据库都要在大数据分一杯羹。
为什么大数据有这样的魔力?因为和当初的云计算一样,大数据身上有一个标签:IT技术趋势和方向。有此标签,自是人人奋勇,各自当先。哪怕是为了政绩,也要有所作为。
所谓“空谈误事”,还是说点实在的。为此,我也求教了北京理工大学大数据搜索与挖掘实验室主任张华平博士。
“4个V不是大数据的定义,而是大数据的特征。大数据本质就是获取知识。”张华平说。
谈到大数据怎样获得,张博士表示,这都不是问题。大数据可以来自行业积累的数据,也可以一些专业的论坛和渠道。他强调,企业要重视数据积累,需要学会将管理行为数字化,例如邮件就是企业重要的数据。
“数据潜伏着知识,就需要通过大数据分析获得。”他说。
他表示,大数据应用是一个生态环境,有提供技术,有提供分析的,也有提供分析解读的。张博士所在的大数据搜索与挖掘实验室就是提供技术的,他们的ICTCLAS((Institute of Computing Technology, Chinese Lexical Analysis System,汉语词法分析系统)如今得到广泛使用,并承诺非商业化用途永远免费使用。
技术产品之外,张华平也在考虑推广使用的模式,一种不同于商业互联网的模式,一种付费使用的模式。未来可以考虑数据提交使用的模式。我们采集了大量的数据,仅微博的目标是100亿条的数据,几乎覆盖每个人。
大数据的解决之道
“数据不是多了,是少了,哪怕是错误的数据,也是有价值的数据。”他说。“知著、见微、晓意”是大数据的解决之道,有更多的数据等待我们去挖据其背后的知识。因此,像云计算一样,大数据并不遥远。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28PCU:游戏运营的 “实时晴雨表”—— 从数据监控到运营决策的落地指南 在游戏行业,DAU(日活跃用户)、MAU(月活跃用户)是衡量 ...
2025-08-28Excel 聚类分析:零代码实现数据分群,赋能中小团队业务决策 在数字化转型中,“数据分群” 是企业理解用户、优化运营的核心手段 ...
2025-08-28CDA 数据分析师:数字化时代数据思维的践行者与价值推动者 当数字经济成为全球经济增长的核心引擎,数据已从 “辅助性信息” 跃 ...
2025-08-28ALTER TABLE ADD 多个 INDEX:数据库批量索引优化的高效实践 在数据库运维与性能优化中,索引是提升查询效率的核心手段。当业务 ...
2025-08-27Power BI 去重函数:数据清洗与精准分析的核心工具 在企业数据分析流程中,数据质量直接决定分析结果的可靠性。Power BI 作为主 ...
2025-08-27CDA 数据分析师:数据探索与统计分析的实践与价值 在数字化浪潮席卷各行业的当下,数据已成为企业核心资产,而 CDA(Certif ...
2025-08-27