京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据迁移的五大陷阱和风险
计算机系统之间的数据传输或存储格式从来就不是一个轻松的任务,特别是当它涉及结构化和非结构化的数据。
"复杂的数据迁移工作意味着超负荷运行和延迟都是很长常见的",Arvind Singh(以下简称辛格),芝加哥一家企业的数据解决方案提供商的联合创始人兼CEO表达了以上观点。
在《信息周刊》的一次电话采访中,Arvind Singh概述了10个常见的数据迁移问题,其中包括五个陷阱和五个风险,以此警告企业应该竭力避免。
大数据迁移的五大陷阱
陷阱#1:未能吸引业务线和业务用户开始。
当公司合并多个系统整合到一个--通常发生在兼并后--他们需要从确定正确的商业用途开始。
你需要确定谁知道和理解业务数据,"辛格说。
"谁是你业务的专家?这当然不是IT或系统集成商。"
换句话说,把那些数据使用精英搬进迁移项目。
毕竟,只有他们才能将那些操作系统玩转一旦上线。
陷阱#2:没有数据管理策略和组织结构。
"你已经将系统A的数据移动到系统B,但谁拥有管理结构?谁有权利在系统中创建、批准、编辑或删除数据?"辛格问。
还有一些问题必须解决:你设置了数据管理了吗?有一个业务流程来管理数据周期吗?另外,你有数据管理员在公司吗?
陷阱#3:在原始系统数据质量差。
公司经常意识不到一个"原有评估"是至关重要的数据迁移工作铺垫。
"了解原始系统里的数据的质量是一个巨大的陷阱,但企业常常不愿意花足够的时间,"辛格说。
必须要考虑的问题:现有的数据支持新用户吗?它缺少什么?你打算怎么做,你现在不能够做什么?
一个详细的评估让企业能够更容易地估计需要的工作量来成功地迁移原始数据。
陷阱#4:忽略验证和定义业务规则。
你公司的业务和验证规则可能不是最新的。
"难以让人相信一个公司在达成业务规则时花了多短的时间,更不用说确保数据符合业务规则,"辛格说。
"换句话说,你认为你有一个业务规则,但是你的现有数据是否匹配,细致,或遵循这个规定?"
此外,审计人员需要确保数据从原始系统到新的系统是有效的,特别是当这个迁移涉及关键信息,如金融、库存、和就业数据。
陷阱#5:未能验证和测试数据迁移过程。
不要以为这是最后一步了。
你绝对绝对要确保在整个过程中你一直在验证和测试,"辛格说。
必须要考虑的问题:你打算怎样测试数据?谁将测试和评估? 谁将签署它吗?以及谁将是数据的最终消费者?
“这一过程必须贯穿项目的始终,但不幸的是公司通常"不花足够的时间校准数据的测试和验证”辛格说。
大数据迁移的五大风险
风险#1:被委托进行数据迁移项目的员工缺乏实战经验。
一个公司的员工可能非常擅长他们所做的事,但这并不意味着他们是在数据管理、迁移和治理是专家。
"他们是数据的创作者和消费者,但是他们并不是完全熟练运用工具、过程、服务、模板和加速器,"辛格说。
风险#2:你的团队太依赖工具的开发工作。
这个问题往往是导致缺乏经验的员工。一个数据迁移项目通常是IT部门的事,但可能并没被专业训练过。迁移工具使用不当最终会迁移了错误数据。"这是类似于把垃圾传来传去,"辛格说。
你的目标,当然是快速、可靠地传输数据。重要的是你如何运用数据迁移工具,和"你搭配的有什么样的加速器和模板,"辛格说。
风险#3:交叉对象依赖性。
"我无法告诉你我有多少次坐在会议上,(客户)说,"我们刚刚发现了一个全新的资料来源,我们甚至都不知道自己需要移动的',"辛格说。
交叉对象依赖常常很晚才被发现。一个复杂的项目可能会有60、70、甚至80个不同的数据对象中来自一百个左右的应用程序。
"当我们与客户谈生意时,我们寻找丢失的数据块,或者相关数据,"辛格说。
事实上,交叉对象依赖性--并在后来发现新的数据来源的过程--是主要的风险,可以打乱你的迁移的时间表。
风险#4:试图在一个大的上传之后去上线。
这是一个灾难,辛格说,因为你在假设一切都是完美的,你将能够简单地点击一个按钮,和所有的数据将负载得完美无瑕。 "这是个很大的风险,"他说。"你需要一个项目时间轴,复杂的,长期的测试负载的道路。"
风险#5:预算超支由于不适当的范围或准备工作的欠缺。
这经常发生在,当一个组织认为它的系统集成商(SI)会照顾到这些细节。
"大多数系统集成商通常不处理数据只是说,'我将连接管道使原始数据移动到一个目标系统',"辛格说。
"在现实阶段,我们可以调用到数据迁移项目,"他说,"人们说:'看,数据没有捆绑在一起,我们无法进行用户测试。'"
这个问题,当然,会导致成本超支和毁坏的时间表。
如今IT
面临的最大挑战之一,是风险评估。风险的度量和影响评估不是一门确切的科学,而是有工具、过程和原理,可用于确保组织很好地被保护,高级管理层消息灵通。在我们的Measuring
Risk: A Security Pro's
Guide测量风险中:一个安全专业人员的指导报告中,我们推荐工具来评估安全风险和提供一些想法供有效地将结果数据投入到业务中去。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在统计学分析、实验研究、业务数据复盘过程中,单因素方差分析是检验自变量对因变量是否存在显著影响的核心方法。其中,两个水平 ...
2026-05-26【核心关键词】算法、客户、大数据、互联网、调优、建模、模型优化、机器学习、评分卡模型、模型开发、智能风控、业务场景、数 ...
2026-05-26 很多数据分析师写过无数个 SELECT,但当被问到“新建一张表,该如何定义字段类型来保证数据质量”“创建视图和存储物理表有 ...
2026-05-26在数据清洗、统计分析与数据质量检测工作中,箱型图(又称箱线图、Box Plot)是最直观、最高效的可视化分析工具之一。相较于柱状 ...
2026-05-25在大数据分析、数据清洗、质量管控、风险监测等领域,异常数据识别是保障数据质量、确保分析结论精准、规避业务决策失误的核心基 ...
2026-05-25 很多数据分析师精通Excel函数和透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么关系 ...
2026-05-25数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18