
互联网大数据技术蓝皮书_数据分析师
DMP(数据管理平台)的概念在互联网广告领域并不陌生。然而,你是否真正需要DMP?你可以从DMP中获取些什么?DMP可以运用到哪些行业、哪些环节?该如何理解DMP的数据价值?你的数据是否安全?以及如何选择一个有价值且可信任的DMP合作伙伴,你是否真的了解?
▲
如何理解数据价值?
GEO对数据价值的理解可以用一个公式来概括:
▲
V=数据价值,U=用户数,V和U是线性关系,用户规模越大,价值越大;N=数据的维度,比如用户的兴趣、购物偏好、活动区域等,V和N是指数关系,维度越多,价值便会指数级增长。特别是在提供DMP服务的同时,技术提供方还能获取更丰富的数据。那么,不断扩张的数据量和数据维度引由此形成滚雪球效应,使得数据的价值成指数级提升。此外,值得注意的还有数据的时效性。T=时间,T和V成线性关系。拿关键词定向为例,数据显示,超过3天的关键词对于展示广告的投放基本失去指导意义。
非Cookie数据 VS Cookie数据,哪个强?
Cookie数据目前主要来源于互联网行业,应用主要集中在精准广告、电子商务、内容推荐等领域。Cookie是一种模糊处理技术,由于浏览器安全限制、Cookie老化、采集范围限制等原因,传统方式采集的Cookie数据不够准确,单用户特征非常稀疏,时间周期也非常短,特别在移动互联网方面Cookie更是失去了其基本价值。
而非Cookie数据来源更为广泛,比如政府开放数据、金融企业开放数据、通讯运营商开放数据、互联网开放数据等。这些数据更加完整,能够精准的定位到一个人,也能够全面反映用户特征,永不过期,且适用于各个行业领域。
GEO DataQuate非Cookie大数据管理平台
GEO DMP(Data Management Platform)是全球第一家非Cookie大数据管理平台。不可否认,传统的Cookie技术在互联网行业曾经广泛应用,但其设计的初衷在于短期存储少量用户信息,在安全性、稳定性、一致性等方面都有诸多先天不足,越来越难以适应迅猛发展的互联网和移动互联网时代的新环境、新需求。
非Cookie大数据管理平台是大数据行业的一个里程碑式的创新,GEO DMP通过多项专利技术,实现了多维数据关联,贯通了数据的生产者和消费者,建立了完整的大数据生态系统。
打通互联网和移动互联网数据
对DMP来讲,最大的难点在于,如何收集和处理数据,如何建立一种ID识别方法来使得提取的数据和使用方的数据能够对应起来,以及如何保护好用户隐私安全。那么,GEO是如何解决这几方面难题的?
众所周知,打通同一个用户在移动互联网和互联网的数据对DMP平台来说至关重要。GEO采用自有知识产权的“移固融合”技术实现了互联网、移动互联网的打通、第一方数据、第三方数据的打通、以及线下数据和线上数据的打通。GEO非Cookie DMP把所有不同类型的数据都统一关联到一个“人”,完整刻画出360°立体的用户画像。
1、“移固融合”的前提是充足的数据。GEO DMP作为最大的非Cookie数据管理平台,拥有多种来源的海量数据。其中,之于“移固融合”技术最关键的固网DPI(Deep Packet Inspection)数据上,GEO处于绝对领先地位:
用户覆盖全:覆盖全国5亿用户,拥有海量数据;
数据维度多:包括用户人口特征、行为特征、业务特征等诸多方面;
渠道来源广:全面覆盖政府、金融、通讯、互联网等各个渠道。
2、“移固融合”的基础是“知识库”的建设。建立成熟的“知识库”需要丰富的经验和长期的积累,GEO的“知识库”开发团队成员主要来自于通信行业,对管道中的数据有充分的理解;
3、“移固融合”的核心是算法。GEO一直重视数据挖掘和算法团队的建设,并且建设了统一的云训练平台,能够同时支持多个团队进行AB测试,不断对模型进行验证。
其次,GEO 非Cookie DMP是一个开放的大数据管理平台,数据来源多样,管理统一,是全球第一个实现通讯、政府、金融、互联网数据大融合的DMP平台,为数据消费方提供了一个统一的数据入口,降低数据使用成本,提高业务效率。
最后,关于如何保护隐私数据安全,是建立一个成熟的大数据平台面临的重要挑战。作为业界领先的大数据技术公司,GEO一直对隐私保护问题尤为重视,并就此作了全方位的布局和设计,这在上一篇我们已经重点讲述过,这里不再赘述。
案例应用
GEO DMP大数据管理平台目前已经在电商、通讯、金融、游戏、快消等诸多行业形成成熟应用,也是国内唯一规模化运营的数据管理平台。采用GEO的技术,业务应用方能够打消数据壁垒、降低数据使用成本、提高传统业务效率、快速验证新业务的可行性及实际应用价值。
案例一:真正的跨屏营销:从"多屏"到"跨屏"
“跨屏广告投放系统”能够对不同设备的广告进行统一的投放管理,提高管理效率,同时也使得投放监控与效果评估有了统一的标准。但是现在常被众人提起的所谓的“跨屏”,仅仅是解决了投放管理的问题,并没有解决投放效果的问题,还有很多不足:
1、不能针对同一个用户进行投放。现有的“跨屏广告投放系统”只能对互联网用户和移动互联网用户分别投放,没有办法识别这些用户是不是同一个人;
2、无法实现跨屏联动。一个用户在手机上的行为无法指导PC广告的投放;
3、跨屏的频次控制。现有的投放系统只能够对互联网广告或移动互联网广告单独控制投放频次,无法做到跨屏的频次控制,广告的实际投放效果不能保证。
GEO的aDirect是全球第一个能够实现跨屏联动的广告投放系统,采用了GEO自有知识产权的移动固网融合技术,用非Cookie数据打通PC和移动端,真正实现了移动和固网的无缝融合,做到跨屏广告的统一投放及管理。基于GEO DMP数据管理平台,aDirect可以实现:
1、移动固网设备ID关联。通过关联,一个用户在使用不同设备上网时,广告投放系统能够知道是同一个人在访问,这样就可以实现真正的跨屏联动;
2、移动和固网数据统一建模分析。GEO拥有自己独立的标签分类体系,针对移动和固网不同来源的数据,GEO采用统一的模型对用户特征进行标注,也就是说模型既可以利用移动数据、也可以利用固网数据,还可以移动固网数据同时使用。不同的数据源不影响模型运算结果的输出;
3、跨屏联动。移动固网ID关联和统一建模技术使得跨屏联动成为现实。aDirect根据统一标注的用户标签,可以实现在PC和手机上同步投放广告:同一个人在同一段时间访问不同设备时,能够看到同样的广告。根据GEO的统计,采用跨屏联动技术可以使广告的转化率提高70%以上;
4、跨屏频次控制。aDirect能够在同样的广告在不同设备显示时,既可以控制一个广告的总投放频次,也可以控制每个设备投放一个广告的频次。
案例二:互联网金融征信:让“陌生人”不再“陌生”
在国外,征信是一个成熟的行业。在美国FICO指数应用非常广泛,从车贷到房贷都可以根据FICO指数快速申请,Trans Union(环联)、Equifax(艾可飞)、Experian(益百利)三大数据公司为FICO提供了完善的基础数据服务。在中国,虽然央行成立了征信中心,也开始面向个人提供征信报告服务,但由于数据不全、维度不够丰富等原因还是不能很好的满足其抵抗风险和个性化服务的需求。
另外一方面,随着互联网金融的爆炸性增长,互联网金融企业对个人征信的需求越来越强烈,主要涵盖以下方面:
1、用户量要大,最好能够覆盖全国用户;
2、数据维度(feature)要丰富,要能够体现用户信用的差异;
3、要长时间的历史数据,最好有若干年的数据;
4、系统查询速度要快,最好能够直接线上完成授信。
对于以上需求,以非Cookie数据为基础的GEO DMP平台很自然的成为了首选。从GEO和国内银行合作的案例来观察,通过GEO DMP提供的用户社交、通讯、位置等数据,结合第一方数据库的线下数据,共同训练了风险控制模型。该模型的应用使得贷款的坏账率降低了2%-5%,实践效果非常显著。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-08-07SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07CDA 数据分析师考试全解析 在当今数字化时代,数据已成为企业发展的核心驱动力,数据分析师这一职业也愈发受到重视。CDA 数据分 ...
2025-08-07大数据时代的隐患:繁荣背后的隐忧 当我们在电商平台浏览商品时,系统总能 “精准” 推送心仪的物品;当我们刷短视频时,算法 ...
2025-08-07解析 F 边界检验:协整分析中的实用工具 在计量经济学的时间序列分析中,判断变量之间是否存在长期稳定的均衡关系(即协整关系) ...
2025-08-07CDA 数据分析师报考条件详解:迈向专业认证的指南 在数据分析行业蓬勃发展的当下,CDA 数据分析师认证成为众多从业者提升专业 ...
2025-08-07通过 COX 回归模型诊断异常值 一、COX 回归模型概述 COX 回归模型,又称比例风险回归模型,是一种用于生存分析的统计方法。它能 ...
2025-08-07评判两组数据与初始数据准确值的方法 在数据分析与研究中,我们常常会面临这样的情况:需要对通过不同方法、不同过程得到的两组 ...
2025-08-07CDA 数据分析师行业标准:构建数据人才的能力坐标系 在数据驱动决策成为企业核心竞争力的时代,CDA(数据分析师)行业标准作为 ...
2025-08-07反向传播神经网络:突破传统算法瓶颈的革命性力量 在人工智能发展的历史长河中,传统算法曾长期主导着数据处理与模式识别领域 ...
2025-08-07MySQL 统计连续每天数据:从业务需求到技术实现 在数据分析场景中,连续日期的数据统计是衡量业务连续性的重要手段 —— 无论是 ...
2025-08-07抖音数据分析师:驱动平台增长的幕后推手 在抖音这个日活用户数以亿计的超级平台上,每一次用户的滑动、点赞、评论,每一条 ...
2025-08-07基于 SPSS 的中介效应分析结果解读:揭示变量间的隐性关联 在社会科学与自然科学研究中,变量之间的关系往往并非简单的直接作用 ...
2025-08-07正态分布与偏态分布的核心区别解析 在统计学中,数据的分布形态是理解数据特征、选择分析方法的基础。正态分布与偏态分布作为两 ...
2025-08-07CDA 一级考试内容详解 CDA(Certified Data Analyst)即数据分析师认证,一级考试作为该认证体系中的入门级别考试,主要面向零基 ...
2025-08-07中介分析的 SPSS 结果解读:从原理到实践 在社会科学、医学、心理学等领域的研究中,变量之间的关系往往并非简单的直接影响,而 ...
2025-08-07