京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据系统与关系型数据的共存
大数据在2011年崭露头角,2012年一飞冲天,它可能会以一种戏剧性的方式改变数据管理的很多方面。大数据系统给管理和操纵计算机数据、连续提取、转换和加载功能、运作商业智能、动态大数据以及基于云的数据仓库等等都带来了变化。
不过,随着大数据进入2013年,已经没有什么系统技术能比NoSQL数据库和Hadoop框架更活跃了,看起来这两款产品还有更大的发展空间。根据MarketAnalysis.com 2012年的一份报告看,单单是Hadoop-MapReduce市场,预计复合年增长率将达到58%,在2018年将达到22亿美元。
NoSQL和Hadoop的出现主要是为应对非结构化数据的,比如文本数据或者web日志。就像Apache Hadoop一样,这些技术通常是从开源起步,逐渐成为新的商业产品。
Judith Hurwitz是Hurwitz and Associates公司的总裁兼CEO,该公司位于美国马萨诸塞州,她认为大数据架构和大规模并行处理大大改变了数据景象。她说:在此之前,即便数据真的对公司很重要,人们也没有能力获取巨大数据量并进行实时分析。
她认为:现在,不现实的东西正变得实用。这种情况已经把数据带出了舒适区。
SQL受创,即将回击
我们可以在网站上看到,2012年伊始,对主流关系型数据库陷入困境的预测就出现了。部分预言已成为现实。SQL关系型数据库在与未来几年可能成为其替代品的产品经过一系列斗争之后,现在(或者很快)似乎面临着关于处理整个企业大数据量过滤的最为剧烈的竞争。
这一趋势背后的推动力是企业对以更快的速率获取更多非结构化数据的渴望,这样企业才能更加依靠数据驱动做出决策。惯用的处理方式正在改变,以适应最好的新技术。
这些来自2012年特定数据管理供应商的举动展现出大数据和Hadoop对关系型数据冲击的现状:
IBM公司还在继续创立小型数据和分析公司,尽管比2011年少了些。蓝色巨人的努力方向从小的改进(比如,针对DB2 10的NoSQL图形库和InfoSphere Warehouse 10)到非常巨大的PureData系统装置,目的都是为了给企业搞定大数据。
甲骨文公司在年初推出了大数据设备。这一发布是紧跟着Oracle NoSQL数据库2.0之后发布的,Oracle NoSQL数据库2.0已经自动实现重新平衡,新的应用编程接口可以处理大型对象,与Oracle数据库有更紧密的集成,支持直接用SQL查询Oracle NoSQL数据库记录。
微软公司展示了Hadoop对Windows Azure和Windows Server支持的预览;Teradata公司发布了其Aster大数据分析产品;而Informatica公司发布了PowerCenter套件的大数据版,据说消除了Hadoop手工编码的需求,并把编程任务带入了Informatica开发环境。
SQL在2012年可能只有一两次回击,但是它积极应对市场挑战的举动有重要意义。在非主流NoSQL和Hadoop方面比较专业的公司更新了他们去年的SQL认证。一个典型的例子是Hadoop创立了Cloudera公司,该公司期望增强SQL与Impala的协作程度(Impala是一款Hadoop软件产品,支持标准SQL做交互式查询)。
大数据的变动
这样的举动可能代表了一定的势头人们看到SQL和NoSQL一起被提及的机会更多了。在某种程度上,SQL在早期大数据喧闹的讨论中有点被淡化了。
Ronnie Beggs是美国旧金山SQLstream公司的副总裁,该公司是一家流媒体数据库制造商。他说:在过去的几年里,由于大数据运动,SQL已经不再挂在每个人的嘴边了。同时,他还说:大数据和NoSQL双剑合璧,已经冲击到了主流。
他还表示,在2013年,我们应该会看到明显的变化,并提到近几年在使NoSQL数据库更好地适应SQL风格的开发方面所作出的各种努力。
Beggs说:它是不断变化的。我们接下来这一年会看到SQL的回归,它将成为所有大数据平台的接口。
这种发展走向了Hadoop框架、NoSQL和SQL方法的共存,这标志着在大数据的成熟度方面迈出了新的一步。2013年,大数据有可能从一个热门话题变为切实的实践。
Colin White是美国俄勒冈州Ashland BI研究机构的总裁和创始人,他说:我认为人们正努力通过大数据的炒作,来真正理解业务价值。在2013年,我认为我们将看到人们从大数据中获得业务价值的优秀案例。问题不在于大数据本身,而在于你的运用。
虽然企业对新技术有着广泛的兴趣,但不是所有公司都会以同样的程度全面部署大数据系统。关于这一点,在最近TechTarget举办的一次重点银行会议上,一位集成服务经理也有所提及。
他认为银行业只有部分涉足了基本的大数据,而不是全部。银行和其它领域只看到了大数据的数量,而没有留意到它的非结构性。至少目前还是这样。
他谈到:大数据的含义有两部分。第一部分是它们的量很大,第二部分是数据为非结构化。银行明显属于第一部分。但是我们不会去收集tweets,至少目前还没有。我们还在观望,等待金融数据服务市场的应对。(文章来自:CDA数据分析师)
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】互联网、机会、运营、关键词、账户、数字化、后台、客户、成本、网络、数据分析、底层逻辑、市场推广、数据反馈、 ...
2026-05-14在Python数据分析中,Pandas作为核心工具库,凭借简洁高效的数据处理能力,成为数据分析从业者的必备技能。其中,基于两列(或多 ...
2026-05-14 很多人把统计学理解为“一堆公式和计算”,却忽略了它的本质——一门让数据“开口说话”的科学。真正的数据分析高手,不是会 ...
2026-05-14在零售行业存量竞争日趋激烈的当下,客户流失已成为侵蚀企业利润的“隐形杀手”——据行业数据显示,零售企业平均客户流失率高达 ...
2026-05-13当流量红利消退、用户需求日趋多元,“凭经验决策、广撒网投放”的传统营销模式早已难以为继。大数据的崛起,为企业营销提供了全 ...
2026-05-13 许多数据分析师精通Excel函数和SQL查询,但当面对一张上万行的销售明细表,要快速回答“哪个地区销量最高”“哪款产品增长最 ...
2026-05-13【专访摘要】本次CDA持证专访邀请到拥有丰富物流供应链数据分析经验的赖尧,他结合自身在京东、华莱士、兰格赛等企业的从业经历 ...
2026-05-12在手游行业存量竞争日趋激烈、流量成本持续高企的当下,“拉新”早已不是行业核心痛点,“留存”尤其是“付费留存”,成为决定手 ...
2026-05-12 很多数据分析师掌握了Excel函数、会写SQL查询,但当被问到“数据从哪里来”“数据加工有哪些步骤”“如何使用分析工具连接数 ...
2026-05-12用户调研是企业洞察客户需求、优化产品服务、制定运营策略的核心前提,而调研数据的可靠性,直接决定了决策的科学性与有效性。在 ...
2026-05-11在市场竞争日趋激烈、流量成本持续攀升的今天,企业的核心竞争力已从“获取流量”转向“挖掘客户价值”。客户作为企业最宝贵的资 ...
2026-05-11 很多数据分析师精通Excel单元格操作,熟练应用多种公式,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质 ...
2026-05-11在互联网运营、产品优化、用户增长等领域,次日留存率是衡量产品价值、用户粘性与运营效果的核心指标,更是判断新用户是否认可产 ...
2026-05-09相关性分析是数据分析领域中用于探究两个或多个变量之间关联强度与方向的核心方法,广泛应用于科研探索、商业决策、医疗研究、社 ...
2026-05-09 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-05-09在数据驱动运营的时代,指标是连接业务目标与实际行动的核心桥梁,是企业解读业务现状、发现问题、预判趋势的“量化标尺”。一套 ...
2026-05-08在存量竞争日趋激烈的商业时代,“以客户为中心”早已从口号落地为企业运营的核心逻辑。而客户画像作为打通“了解客户”与“服务 ...
2026-05-08 很多数据分析师每天与Excel打交道,但当被问到“什么是表格结构数据”“它和表结构数据有什么区别”“表格结构数据有哪些核 ...
2026-05-08在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07