
构建大数据分析平台:没有捷径
通过创新、敏捷实践和IT内部划分等各种途径。为了实现这一点,相对于推动部门的转型,CIO们必须面对更为艰巨的挑战。他们需要向业务端显示自己在变革 方面的主导地位。但正如在近期于波士顿举行的大数据创新峰会上所显示的一样,在推动企业的数字化转型上,IT没有捷径可走。
“从总体上说,企业内部的IT组织最重要的任务就是防止故障的发生。”在峰会中的一次讨论中,NBCUniversal Media LLC的分析技术集团高级总监Moin Haque表示:“高层对IT的评估就是,以服务标准协议的形式来检验故障的多寡。在这种情况下,IT并没有进行试验和失败的空间。”但是,Haque的 分析团队则恰恰相反,其使命就是探索和实验,哪怕失败也在所不惜。
NBC的大数据分析平台是IT双重角色的最好例证:IT团队管理着自建的Hadoop平台;Haque的团队则置身于IT之外,通过各种试错来探索价值创 新。由于这两个团队的工作目标和节奏都不一样,Haque认为单独运作会带来明显的好处:“把责任属性从我们团队中去掉,可以让我们更加专注的进行探 索。”
是否外包
对于其他意在构建大数据分析平台的企业,Haque的建议也是如此:“那些能够自行完成或通过合作伙伴实现的工作,可以作为切入点。”实际上,当某位听众问到如何外包或引入大数据项目时,Haque的建议就是从另外的角度进行分解。
Haque表示,可以放到IT团队进行管理,也可以进行外包(如果企业尚不具备相应的大数据技能时)。同时,他也认为,只有在极少数情况下才需要将大数据分析外包出去。
“无论是开发模型还是算法,你都应该尽量走自建的道路。因为这样才能具有真正的独特性,才能使企业更具竞争力。”Haque认为。
人才培育
Chris Simokat是花旗集团的副总裁和大数据分析工程团队首席数据科学家,他同样提出了自己的看法。与其因为技能匮乏而把平台外包,CIO更应该注重内部的 人才发现和培养。“我们平台的起源和核心工程组件,来自于PeopleSoft工程团队的副产品。”Simokat表示。
对于Haque建议对大数据项目分解成更为可管理的模块,Simokat表示了赞同。同时,他认为应该在IT团队内部挖掘人才,对每个细分模块进行管理。即便对于那些已经外包的工作,也应如此。
“否则,就是厂商调查的不尽职,从而无法对工作进行切实的掌控。”Simokat表示。
创新的悖论
CIO和企业都表示在尽力寻找具有创新性思维的人才,但是这其实并不容易。“绝大多数的创新性人才都令人感到棘手,他们总是倾向于改变一切。”联合国助理秘书长和首席信息技术官Atti Riazi表示。她认为没有任何政府部门和企业能够容忍这一点。
Riazi表示,创新,历来都是一把双刃剑,能够解决艰难的问题,也往往导致意想不到的后果。“以互联网为例,已经成为我们生活的一部分,但是同样充斥着种种诸如贩卖人口之类的黑暗面。”Riazi举例说。
Riazi表示这并不意味着CIO们应该拒绝创新。相反,创新是进步的源泉。只不过,她认为听众应该对技术本身进行讨论,尤其是当技术被当作他用时。“提 到技术,我们总是想到硬件、软件、工具和云计算。但是,其中的内涵远不止如此,技术其实和经历、权力、人类的生活乃至环境有关,我们必须就此展开对话和思 考。”
Riazi认为,试图对技术和创新进行管理是错误的,这只会扼杀应有的活力。“那么该做什么呢?把创新看做一种责任。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01