京公网安备 11010802034615号
经营许可证编号:京B2-20210330
为什么数据分析计划总是失败
强大的数据分析是一项数字业务命令式——这一切都始于智能数据治理实践,以及对质量和环境的重视。
高管们谈论的大多是普通数据的价值,但Navient Solutions公司的企业数据情报总监Michele
Koch却可以计算出公司数据的实际价值。事实上,Koch可以用实际的美元计算出公司的各种数据元素所带来的收入增加和成本下降。因此,她明白,Navient的数据中存在能够损害其企业底线的问题。例如,客户档案中的关键数据字段中的一个错误就可能意味着该公司无法以最低的成本处理贷款。
“由于这里涉及金钱,因此我们需要一个数据质量仪表板,用以跟踪所有的、我们追踪的、实际的、潜在的价值。”Koch说。
另外,首席数据管理员兼财务副总裁Barbara
Deemer表示,位于特拉华州威尔明顿的一家资产管理和业务处理服务公司Navient内部的一项早期数据相关举措展露了风险。2006年的举措侧重于提高营销数据质量,并产生720万美元的投资回报率,并从增加贷款量和减少运营支出中获得回报。
Koch说,从那以后,Navient公司的高管们都承诺支持强有力的数据治理计划,这是成功分析工作的关键部分。Navient的治理计划包括长期公认的最佳实践,例如标准化数据字段的定义和确保干净的数据。它为大约2600个企业数据元素分配所有权。所有权属于数据字段最初产生的业务领域,要么转到特定数据字段是其流程更不可或缺的业务领域。
该公司还有一个数据质量计划,积极监测领域的质量,以确保不断满足高标准。该公司还推出了数据治理委员会(2006年)和分析数据治理委员会(2017年),以解决持续存在的问题或疑虑,在整个企业做出决策,不断改进数据操作以及数据如何为公司的分析工作提供支持。
Koch说“数据对于我们的商业计划和新的商业机会非常重要,我们希望将重点放在改进支持我们分析程序的数据上。”
根据数据治理方案公司Erwin和UBM的数据治理,大多数高管都认为以合规、客户满意度和更好的决策为主要驱动力的数据治理是至关重要的。然而,报告发现,近40%的响应组织没有单独的数据治理预算,约46%的组织没有正式的数据治理策略。该项调查结果基于包括CIO、CTO、数据中心经理、IT人员和顾问等在内的118个受访者的问题。
鉴于这些数据,专家表示,许多企业数据项目中存在弱点并不意外,下面是7个此类问题的数据实践。
把数据整合在一起,但不是真正的整合
数据治理专业组织的通信副总裁Anne Buff说,在当今的数据和分析领域中,集成是最重要的挑战之一。
诚然,许多组织将所有数据集中在一个地方。但在现实中,他们并没有整合来自多个数据源的各个部分。因此,来自一个系统的Bill Smith与其他系统产生的数据(以及它完整的变化)都没有关系,这给业务带来了多个不完整的定义。
共存数据与集成该数据不同,你必须有一种方法来匹配来自不同来源的记录,你需要做到当这一切都结合在一起时,它应该创造更大的观点,并且利用一些东西来作为连接点。
不同的数据集成技术可以实现这一点,选择、实现和执行正确的工具对于避免过多的手工工作或重复做相同的工作是至关重要的。
此外,整合正变得越来越重要,因为数据科学家正在寻找数据中的模式,以获得能够产生突破、竞争优势等方面的洞见。
“但是,如果你不能把从前从未合并过的数据组合在一起,你就找不到这些模式。”北卡罗纳州Cary的SAS资讯业务解决方案经理Anne Buff说到。
没有实现业务单位有独特的需求
是的,整合的数据对于一个成功的分析程序至关重要。但一些商业用户可能需要不同版本的数据。一种形式的数据不能满足整个组织内每个人的需求。
相反,它需要考虑数据供应,即提供由业务用户或业务部门确定的业务案例所需的数据。
以一家金融机构的不同需求为例。虽然一些部门可能需要整合数据,但欺诈检测部门可能希望其数据科学家使用不受约束的数据,这样他们就可以搜索到危险信号。他们可能想在同一个地址搜索某人,使用他们个人身份信息的细微变化来申请多个贷款。
“你将会看到类似的数据元素,但有一些变量,所以你不想把这些差异弄得太大,把它弄得太干净,”Anne Buff解释说。另一方面,她还表示,金融机构的营销部门希望有正确的客户名称、地址和合适的目标通信。
只招聘数据科学家,而不是数据工程师
随着公司试图超越基本商业智能,以预测和规范分析,以及机器学习和人工智能,它们需要提高数据团队的专业水平。这使得数据科学家的地位受到了关注,另外数据工程师也同样重要,他们需要手机数据来完成数据科学家的工作,但到目前为止,这在许多企业中受到的关注都较少。
Bain & Co.旧金山办公室的合伙人、高级分析和数字实践的领导者Lori Sherer说,这种情况一直在改变。“我们看到,对数据工程师的需求增长大约是数据科学家需求增长的两倍,”Sherer说。
美国联邦劳工统计局(federal Bureau of Labor Statistics)预计,未来10年,对数据工程师的需求将继续快速增长,2016年至2026年,美国经济将增加44,200个职位,平均年薪已达135,800美元。
然而,就像许多关键岗位一样,专家们表示,没有足够的数据工程师来满足需求——这使得IT部门现在才刚刚开始招聘或培训招聘岗位。只招聘数据科学家,而不是数据工程师。
将数据保存在初始状态,而不是管理它的生命周期
在过去的十年中,存储成本急剧下降,使其能够更轻松地存储大量的数据,比以前任何时候都要长。考虑到目前数据的容量和速度以及对数据的分析需求的增加,这似乎是个好消息。
不过,佛罗里达州Apollo Beach咨询公司Eagle Consulting的联合创始人Penny
Garbus表示,尽多人都对拥有大量数据的价值表示欢迎,这往往都是好事。Garbus说,太多的企业对数据持有的时间太长。她说:“你不仅要为它付费,而且如果它存储超过10年,那么信息就很可能脱离时代了。”“我们鼓励人们在上面写注明时间表。”
Garbus说,数据的截止日期不仅从组织到组织,每个部门都不同。零售公司的库存部门可能只需要相对较近期的数据,而市场营销可能需要数年的数据来跟踪趋势。
如果是这样的话,它需要实现架构,将数据的正确时间框架交付到正确的位置,以确保每个人的需求得到满足,并且旧数据不会损坏及时的分析程序。
正如Garbus指出的那样,仅仅因为你必须保存(旧数据),并不意味着你必须把它放在你的核心环境中。你只要拥有它就行了。
Bain & Co.旧金山办公室的合伙人、该公司高级分析和数字实践的领导者Lori
Sherer说,这种情况一直在改变。我们看到,对数据工程师的需求增长大约是数据科学家需求增长的两倍。美国联邦劳工统计局(federal
Bureau of Labor
Statistics)预计,未来10年,对数据工程师的需求将继续快速增长,2016年至2026年,美国经济将增加44,200个职位,平均年薪已达135,800美元。
然而,就像许多关键岗位一样,专家们表示,没有足够的数据工程师来满足需求——这使得IT部门现在才刚刚开始招聘或培训招聘岗位。
专注于量,而不是目标相关性
IT咨询公司Booz Allen Hamilton的高级副总裁Steve Escaravage说:“我们仍在构建模型,并使用最有效的数据进行分析,而不是使用最相关的数据。”
他说,组织经常错误地认为他们应该捕捉并添加越来越多的数据集。他们认为“也许有些东西我们没有找到,而不是怀疑数据的正确性”
考虑到许多机构通过分析大量数据来寻找异常现象来判断欺诈行为。在一个重要的活动中,领先的机构也会分析更有针对性的数据集,从而产生更好的结果。在这种情况下,他们可能会关注那些产生某种交易的个人或机构,这些交易可能预示着麻烦。或者,医疗机构在分析病人的结果时,可能会考虑到医生在提供病人护理时的轮班时间。
Escaravage表示,组织可以从创建一个数据愿望清单开始。尽管这一过程从业务方面开始,“捕获它并使其可用的机制,这是CIO、CTO或首席数据官的领域。”
提供数据,但忽略它来自哪里
今天的一个大主题是“分析偏见”,它可以扭曲结果,甚至产生错误的结论,导致糟糕的商业决策或结果。Escaravage说,在企业分析程序中,产生偏差的问题存在于许多不同的领域,包括如何处理数据本身。
他说,通常情况下,追踪数据来源的工作做得不够好。
“如果你不知道这一点,它就会影响你的模型的性能,”Escaravage说,他注意到数据来源的不可见性,以及数据来源如何使得控制偏见变得更加困难。
“了解数据来自哪里以及发生了什么,是我们的责任。”在数据管理方面有如此多的投资,但也应该有一个元数据管理解决方案。
提供数据,但不能帮助用户理解上下文
Escaravage说,它不仅应该有一个强大的元数据管理程序,它可以跟踪数据的来源,以及它如何在系统中运行,它应该为用户提供对某些历史的洞察,并为一些通过分析产生的结果提供上下文。
“我们对自己能创造的东西感到非常兴奋。”我们认为我们有很好的数据,特别是没有被分析的数据,我们可以建立一个关于这些数据价值的新型模型。“但是,尽管过去5年的分析方法令人惊讶,但这些技术的结果比过去在数据挖掘后应用业务规则时的解释要少,而且很容易解释数据。”
Escaravage解释说,较新的深度学习模式提供了见解和可操作的建议。但这些系统通常不会提供对最佳决策有用甚至至关重要的上下文。例如,它不提供关于概率的信息和基于数据的确定性。
Escaravage说,需要更好的用户界面来提供这种环境。
“技术问题是人们如何与这些模型交互。从透明的角度来看,关注UI/UX是非常重要的。因此,如果有人看到了来自人工智能平台的推荐,他们能在多大程度上深入了解潜在的数据来源,等等?”他说。“CIO们将不得不问如何在他们的系统中建立这样的透明度。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05数据治理是数字化时代企业实现数据价值最大化的核心前提,而CDA(Certified Data Analyst)数据分析师作为数据全生命周期的核心 ...
2026-03-05在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04