京公网安备 11010802034615号
经营许可证编号:京B2-20210330
物联网驱动下的大数据管理
物联网的价值在于其数据,而物联网带来的史无前例的数据规模将驱动现在的数据服务企业发生根本性改变,这要求企业调整其大数据战略。
具有“大数据时代预言家”之称的维克托·迈尔曾经在自己的著名论著《大数据时代》中预言——物联网(IOT)技术的发展将极大地改变传统数据存储分析领域。这就难怪有那么多的公司正试图投身物联网大潮。据麦肯锡全球研究院的最新报告显示:到2025年,物联网行业的总营收将达6.2万亿美元。
但正如维克托担心的一样——这些弄潮儿们真的为物联网将造就的大数据时代做好准备了吗?
当然,除了技术层面的考虑,安全问题也不容忽视。但是,笔者更关心的是:全球大多数的数据中心(包括那些专门非盈利性的数据存储和分析机构)对由物联网即将带来的海量数据似乎毫无准备。
当然有一些科技公司仍然坚持认为自己完全有能力管理好自己的数据中心,但是当数据量以PB或者EB为单位增加时,不知道这些公司是否还认为笔者庸人自扰?如果依旧固执己见,那么他们就不得不对相应的基础设施进行大笔的投资。而相对聪明的公司会选择业界领先的云存储公司作为自己的战略同盟。所以,由物联网引起的大数据潮流将会助推云存储和云计算的发展。
物联网产生的大数据处理过程可以归结为三个基本步骤:数据采集、数据存储和数据分析。数据采集和存储是基本的功能,而大数据时代真正的价值蕴含在数据分析中。对于大数据时代的到来,有专家曾经估计有半数以上的大数据公司可能夭折,而原因是他们未能掌握数据采集相关技术。当然也并不是说过了数据采集这个难关就可以万事大吉,接下来在数据存储方面仍有一连串的挑战。比如,公司必须掌握如分布式计算、并行计算等先进的存储计算方法。
2009年,甲型H1N1流感病毒肆虐全球。与流感病毒传播速度相比,美国政府对流感病例的申告制度显得效率低下。这时候人们才重新注意流感病毒爆发前几周,谷歌公司几位工程师在《Nature》上发表的一篇文章。在文章中,谷歌公司通过对全美境内5000万条最频繁检索的词条和美国疾控心公布的季节性流感传播数据进行比较发现:在未来一段时间很可能爆发一次大规模的流感疫情,而且清楚预测出了具体的地区和州。最后疫情爆发的时候,疾控中心惊讶地发现谷歌公司的预测竟然与疫情爆发地精准吻合。所以,对于大数据时代而言真正的意义在于数据分析。
数据分析的挑战还在于将新的物联网数据和已有的数据库整合。iDoNews认为,有两个方面最令人头疼。首先,软件方面——原来的数据库与物联网数据库之间使用的存储方法不同,这时候就要求公司不得不靠大量的人工重新定义原来的海量数据。第二,硬件方面——两种数据库之间所使用硬件介质(服务器、磁盘等存储介质和网络等基础设施)不同,这将导致公司需要进行更大规模的基础设施建设。
这时候如果还有公司想靠自己一方的努力管理本公司数据,那无疑是作死。
为此,真正有眼光的企业可以采用如下三种方案:
第一种,也是最流行的方式——利用成熟的第三方数据库服务(DBaaS),如亚马逊的Redshift.这种模式的优势在于,客户公司不需要具备安装、管理和运行任何大型数据库的经验和技术。
第二种,利用大数据托管服务。托管服务供应商(MSP)将负责数据收集、数据库管理并提供进行分析和提取数据集的服务。这种模式不仅使企业专注于其商业价值所在的数据分析而将一些较难处理的事情外包,而且还使企业用户无需大量先期投入就可以快速进入大数据应用的市场化阶段,同时也解决了很多企业在该领域的技术短缺。
第三种,基于云计算的数据库矩阵解决方案。这种模式主要针对那些具有多种不同类型、甚至非联系型数据库的公司。这些公司通常要求数据存放于多个数据中心,并且既存于公共端也可能存在私有的云端。公司不仅要求不同类型数据库的解决方案,而且对自身的大数据也有不同的应用需求。美国主机服务商ServePath下的GoGrid云计算平台正致力于这种数据库管理服务。
物联网的价值在于其数据,而物联网带来的史无前例的数据规模将驱动现在的数据服务企业发生根本性改变,这要求企业调整其大数据战略。等着瞧吧,物联网必然催生出大数据管理领域的大赢家。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、业务决策、科学研究等领域,统计模型是连接原始数据与业务价值的核心工具——它通过对数据的规律提炼、变量关联分析 ...
2026-02-14在SQL查询实操中,SELECT * 与 SELECT 字段1, 字段2,...(指定个别字段)是最常用的两种查询方式。很多开发者在日常开发中,为了 ...
2026-02-14对CDA(Certified Data Analyst)数据分析师而言,数据分析的核心不是孤立解读单个指标数值,而是构建一套科学、完整、贴合业务 ...
2026-02-14在Power BI实操中,函数是实现数据清洗、建模计算、可视化呈现的核心工具——无论是简单的数据筛选、异常值处理,还是复杂的度量 ...
2026-02-13在互联网运营、产品迭代、用户增长等工作中,“留存率”是衡量产品核心价值、用户粘性的核心指标——而次日留存率,作为留存率体 ...
2026-02-13对CDA(Certified Data Analyst)数据分析师而言,指标是贯穿工作全流程的核心载体,更是连接原始数据与业务洞察的关键桥梁。CDA ...
2026-02-13在机器学习建模实操中,“特征选择”是提升模型性能、简化模型复杂度、解读数据逻辑的核心步骤——而随机森林(Random Forest) ...
2026-02-12在MySQL数据查询实操中,按日期分组统计是高频需求——比如统计每日用户登录量、每日订单量、每日销售额,需要按日期分组展示, ...
2026-02-12对CDA(Certified Data Analyst)数据分析师而言,描述性统计是贯穿实操全流程的核心基础,更是从“原始数据”到“初步洞察”的 ...
2026-02-12备考CDA的小伙伴,专属宠粉福利来啦! 不用拼运气抽奖,不用复杂操作,只要转发CDA真题海报到朋友圈集赞,就能免费抱走实用好礼 ...
2026-02-11在数据科学、机器学习实操中,Anaconda是必备工具——它集成了Python解释器、conda包管理器,能快速搭建独立的虚拟环境,便捷安 ...
2026-02-11在Tableau数据可视化实操中,多表连接是高频操作——无论是将“产品表”与“销量表”连接分析产品销量,还是将“用户表”与“消 ...
2026-02-11在CDA(Certified Data Analyst)数据分析师的实操体系中,统计基本概念是不可或缺的核心根基,更是连接原始数据与业务洞察的关 ...
2026-02-11在数字经济飞速发展的今天,数据已成为核心生产要素,渗透到企业运营、民生服务、科技研发等各个领域。从个人手机里的浏览记录、 ...
2026-02-10在数据分析、实验研究中,我们经常会遇到小样本配对数据的差异检验场景——比如同一组受试者用药前后的指标对比、配对分组的两组 ...
2026-02-10在结构化数据分析领域,透视分析(Pivot Analysis)是CDA(Certified Data Analyst)数据分析师最常用、最高效的核心实操方法之 ...
2026-02-10在SQL数据库实操中,字段类型的合理设置是保证数据运算、统计准确性的基础。日常开发或数据分析时,我们常会遇到这样的问题:数 ...
2026-02-09在日常办公数据分析中,Excel数据透视表是最常用的高效工具之一——它能快速对海量数据进行分类汇总、分组统计,将杂乱无章的数 ...
2026-02-09表结构数据作为结构化数据的核心载体,其“获取-加工-使用”全流程,是CDA(Certified Data Analyst)数据分析师开展专业工作的 ...
2026-02-09在互联网产品运营、用户增长的实战场景中,很多从业者都会陷入一个误区:盲目投入资源做推广、拉新,却忽视了“拉新后的用户激活 ...
2026-02-06