
大数据时代下数据中心变革
“用数据爆炸形容今天的IT发展一点也不为过,数据增长永无止境。”世纪互联李志霄博士认为对于企业来说,与用户使用习惯、地理分布、甚至企业需求变动都可以通过在大数据挖掘得到有价值的参考信息。大数据时代将信息价值的概念推到了企业CIO面前。
根据国际数据公司IDC 2011年发布的Digital Universe
Study,全球信息总量每过两年,就会增长一倍。仅在2011年,全球被创建和被复制的数据总量为1.8ZB(1.8万亿GB)。相较2010年同期上涨超过1ZB,到2020年这一数值将增长到35ZB。这就是大数据的创建和产生。
“我们看现在的Facebook,全球用户数量正在逼近10亿,中国的新浪微博注册用户数量也已经破3亿,腾讯的即时通讯工具活跃用户达到7.1亿,仅次于中国和印度的人口数字。仅社交网络这一项所产生的数据就已经非常惊人。”
数据高效处理需求驱使数据中心变革
数据流量每上升一个数量级,要求IT具备相应的高效率处理能力,从而引发IT的革命。从PC机出现、互联网普及到今天的云计算,都是为提升IT效率而出现的技术和解决方案。
IDC预测2020年,全球所有IT部门拥有服务器的总量将会比现在多出十倍(包括虚拟机和物理机),所管理的数据增长50倍,而IT管理人员的总数增长幅度仅仅只会向上浮动1.5倍。大数据高效存储、有效提取的需求正在敦促传统数据中心向满足云计算应用条件的数据中心转型。
“虚拟化技术提升了传统物理机的使用效率,通过云计算形成资源池,数据散列分布于资源池的不同物理机上。大数据挖掘工具在其中起到指针的作用,根据对信息内容的需求指向信息存储的空间,形成数据仓库。这一系列改变的发生都将在云计算数据中心发生。”
绿色节能成为必备条件
“从设备上说,服务器、机房、带宽、电力、制冷等硬件设施相比于传统数据中心并不会发生本质性的变化,但是会以绿色节能为宗旨去发展。数据中心耗电未来会是个很大的议题。”
史丹佛大学土木与环境工程系的教授ohnathanG.Koomey针对数据中心对全球耗电量印象的报告称,全球的数据中心在2010年共消耗1,988亿千瓦时的电力,约是全年总发电量的1.1至1.5%,而这个比例不可小视。电力已经成为数据中心份额最大的支出项,Google、微软等数据中心大户开始尝试将数据中心建设在严寒地带以减少电力消耗。
“IT的价值在于节约数据处理的成本,云计算则帮助企业降低IT成本。”李志霄博士指出云计算数据中心通过大规模数据中心集成的方式,降低数据处理的平均费用。大型云计算数据中心将更多考虑所在的地域环境,充分利用自然条件降低能耗,如当地低温气候,风能、潮汐、太阳能等清洁能源。
数据中心运营服务外包
李志霄博士认为云计算数据中心最本质的改变在于软件和服务。软件包括实现存储、计算能力调用、计费、安全等的虚拟化、分布式等技术,以微软、亚马逊为前例;服务的改变意味着传统物理机房的运维DNA将作为优质服务的前提条件,而非全部内容。运维工程师由维护物理机房转变到软件平台、网络平台的维护,比如Debug。
随着云数据中心规模化发展,运维服务从硬件维护走向软硬兼具,运维服务的难度与规模相应扩大。“运维服务走向专业化、外包化将成为行业趋势,在这一领域机遇与挑战并存。具备运维DNA数据中心企业将有机会成长为专业的云数据中心运维服务提供商。世纪互联作为一家拥有十几年运维DNA的数据中心服务提供商,未来对云的探索值得期待。”
云数据中心需要顶层设计
中国目前拥有58.8万个数据中心,高工产业研究院数据显示2011年新建数量达6800个,其中不包括各地正在规划的云计算数据中心。大数据背景下,如何看待中国云计算数据中心的快速增长,李志霄博士提出了自己的理解。
“由于意识到虚拟化技术,多租户技术的浪潮来临,美国2011年将政府IDC由2000个减到1200个,注意,是减,不是增。但这个前提是云计算应用已经相当普遍。在中国,云数据中心正处于建设期,正是政府参与进行顶层设计,整体规划的最佳时机。”
李志霄博士认为,与电子政务、教育、医疗等相关的公有云大数据将会推进智能城市的发展。公有云落地之时,中国云计算数据中心的变革才会真正到来。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29