
大数据跨界应用尚待突破_数据分析师
“如果中国的大数据全打通,能够创造出更多有价值的增值服务,甚至创新财富。”在贵阳数博会期间,从北京来到贵阳参展的国双公司总裁助理周喜对记者说,由于信息保密方面的问题,大数据还难以跨界应用,实现利益最大化。全面的数据打通目前来说还只是一个“理想”的状态。
记者在采访中也深深感觉到,许多优秀的国内企业以及一些国外企业,都在各自所在的领域对于数据进行了收集、整理和挖掘,并将之应用到这个行业,提供提升行业效率和改变行业生态模式的一些解决方案,但是几乎没有看到跨界、跨领域的大数据成功应用案例,数据跨界连接等模式尚未成熟。
周喜解释说,用户信息源一定要有线索流,就是如何判断哪些数据是同一个单一用户的,企业可以不知道这个人叫什么和他的年龄,但是一定要知道在各行各业的数据里面,哪些数据是这个用户所产生的。只有把这个线索流梳理清楚,应用大数据去做整合,才能产生块数据,随之产生和实现新的应用和服务。
然而,大家都在收集自己的行业数据,而不同行业间的数据很难做到线索流的打通,不同大数据企业之间的数据也难以打通,第三方也不可能拿到这些企业的数据并进行线索流的分析。
周喜认为,现在存在最大的问题就是线索流无法打通,行业之间,企业原有针对传统应用的系统和其它业务模块数据之间无法连通,这是一个核心的问题。
周喜举了一个简单的例子,说明了很小的案例中线索流也难以做到打通。比如,在与某汽车品牌合作的时候,曾经遇到最大的困难就是判断在现场买车的这个人,他到底跟线上的行为有什么关系。客户原有的数据要和国双的数据匹配,这样才能将线索流做到打通。企业还需要不断往前追溯,了解购车人在哪个4S店进行购买,他之前试乘试驾了没有,接待他的经理是谁,然后再往前追溯客服中心有没有给他打过电话,他来填写网上的试乘试驾信息的时候是通过哪一个媒体的哪一个广告点位来的,或者是搜索引擎的哪一个关键词来的。再往前追溯的话,还需要了解诸如通过哪些媒体的点位到了网站,却没有产生有效行为,诸如第一次是通过哪些点位来的。一旦将这些所有的数据追溯分析完之后,就变成了一个庞大的整合营销销售流,而其中很关键的一点就是线索流的统一。
周喜认为,信息保密方面的问题使得任何一个用户对自己的行为和自己的线索,都不希望被别人看见的。比如说,他到京东上去买东西,京东有了他的数据;他接下来又去淘宝了,那京东和淘宝是不可能打通这个数据的,第三方也不可能把他们的数据拿到并且进行线索流的分析。
周喜以“理想很丰满,现实很残酷”,来总结数据分割这一状况,并认为这一状态将在相当一段时间内存在。他表示,大数据行业目前的现状还是散而杂,集中度比较低,因此企业最多只能成为某个细分领域的领军者。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
线性相关点分布的四种基本类型:特征、识别与实战应用 在数据分析与统计学中,“线性相关” 是描述两个数值变量间关联趋势的核心 ...
2025-09-25深度神经网络神经元个数确定指南:从原理到实战的科学路径 在深度神经网络(DNN)的设计中,“神经元个数” 是决定模型性能的关 ...
2025-09-25在企业数字化进程中,不少团队陷入 “指标困境”:仪表盘上堆砌着上百个指标,DAU、转化率、营收等数据实时跳动,却无法回答 “ ...
2025-09-25MySQL 服务器内存碎片:成因、检测与内存持续增长的解决策略 在 MySQL 运维中,“内存持续增长” 是常见且隐蔽的性能隐患 —— ...
2025-09-24人工智能重塑工程质量检测:核心应用、技术路径与实践案例 工程质量检测是保障建筑、市政、交通、水利等基础设施安全的 “最后一 ...
2025-09-24CDA 数据分析师:驾驭通用与场景指标,解锁数据驱动的精准路径 在数据驱动业务的实践中,指标是连接数据与决策的核心载体。但并 ...
2025-09-24在数据驱动的业务迭代中,AB 实验系统(负责验证业务优化效果)与业务系统(负责承载用户交互与核心流程)并非独立存在 —— 前 ...
2025-09-23CDA 业务数据分析:6 步闭环,让数据驱动业务落地 在企业数字化转型中,CDA(Certified Data Analyst)数据分析师的核心价值,并 ...
2025-09-23CDA 数据分析师:以指标为钥,解锁数据驱动价值 在数字化转型的浪潮中,“用数据说话” 已成为企业决策的共识。但数据本身是零散 ...
2025-09-23当 “算法” 成为数据科学、人工智能、业务决策领域的高频词时,一种隐形的认知误区正悄然蔓延 —— 有人将分析结果不佳归咎于 ...
2025-09-22在数据分析、金融计算、工程评估等领域,“平均数” 是描述数据集中趋势最常用的工具之一。但多数人提及 “平均数” 时,默认指 ...
2025-09-22CDA 数据分析师:参数估计助力数据决策的核心力量 在数字化浪潮席卷各行各业的当下,数据已成为驱动业务增长、优化运营效率的核 ...
2025-09-22训练与验证损失骤升:机器学习训练中的异常诊断与解决方案 在机器学习模型训练过程中,“损失曲线” 是反映模型学习状态的核心指 ...
2025-09-19解析 DataHub 与 Kafka:数据生态中两类核心工具的差异与协同 在数字化转型加速的今天,企业对数据的需求已从 “存储” 转向 “ ...
2025-09-19CDA 数据分析师:让统计基本概念成为业务决策的底层逻辑 统计基本概念是商业数据分析的 “基础语言”—— 从描述数据分布的 “均 ...
2025-09-19CDA 数据分析师:表结构数据 “获取 - 加工 - 使用” 全流程的赋能者 表结构数据(如数据库表、Excel 表、CSV 文件)是企业数字 ...
2025-09-19SQL Server 中 CONVERT 函数的日期转换:从基础用法到实战优化 在 SQL Server 的数据处理中,日期格式转换是高频需求 —— 无论 ...
2025-09-18MySQL 大表拆分与关联查询效率:打破 “拆分必慢” 的认知误区 在 MySQL 数据库管理中,“大表” 始终是性能优化绕不开的话题。 ...
2025-09-18DSGE 模型中的 Et:理性预期算子的内涵、作用与应用解析 动态随机一般均衡(Dynamic Stochastic General Equilibrium, DSGE)模 ...
2025-09-17Python 提取 TIF 中地名的完整指南 一、先明确:TIF 中的地名有哪两种存在形式? 在开始提取前,需先判断 TIF 文件的类型 —— ...
2025-09-17