京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据与区块链:一对桴鼓相应的搭档
大数据能够对海量信息资产通过高效的处理模式来进行捕捉、管理和处理,而区块链本身作为分布式计算的一种,还有去中心化以及不可篡改等特性,两者之间,似乎天然就有合作的可能性。
大数据虽然能够收集海量数据并进行处理,但却无法保证数据的安全性,而作为虚拟货币底层技术的区块链,在这方面却是天赋凛然,自两者诞生之初,便有着强大的吸引力。
不完美的大数据
在前段时间,百度CEO李彦宏曾经说过,中国用户更倾向于用隐私换取便捷性。更准确来说,应该是中国用户被动甚至是被迫共享自己的隐私来换取便捷性。比如现在许多手机APP,强迫用户必须同意接受一些隐私采集条款,才能够正常使用,若不同意,则完全无法使用。
通常而言,应用软件采集用户数据,通过云计算,将对这些用户的大数据进行分类检索,提取有价值的信息,然后为用户提供便捷性服务。这种行为显然是双赢的,企业采集到了有效的数据,用户也体验到了更好的服务。
但是问题在于,李彦宏的说法是用户自愿用隐私换取便捷性。相信涉及到隐私的时候,没有多少用户是心甘情愿的,并且无论用户的隐私数据是否安全,随意获取这些数据都让人感到不适。联系到最近Facebook用户隐私数据泄露事件,大数据安全依然是严峻的问题。
并且收集到用户隐私数据之后,有可能还会被大数据杀熟,通过数据判断用户为高收入群体,在其购买以及消费产品时,将会比平常更加昂贵,届时由于更加成熟的大数据辨别机制,即使通过分享给好友来确认也无法察觉自己已经被“杀熟”。
其次,收集用户大数据之后,企业可以更加精准的推送相关广告,但是这些数据收集之后,用户完全没有任何受益,广告费用全部都被相关公司赚取,这相当于把用户的东西抢走之后,再加价卖回来,这种情况虽然很普通,但是真的合理吗?
让区块链为大数据加密
区块链则可以利用其自身特性,利用秘钥限制这些应用的访问权限,并且可以溯源追查自己的隐私数据都被用于哪些方面,可以做到用户自身完全掌控自己的数据,让用户更加方便的管理属于自己的权限,推动大数据的进一步增长。
就以上面的广告精准推送来说,用户可以通过区块链,完全把控自己的隐私数据,这也就意味着,用户可以决定自己的数据是否出售给相关广告商,广告的推送权也回归到用户的手中。并且如果用户同意分享自己的数据,那些广告的收入,也将会拿到属于自己的一份。
再举一个例子,通常而言,大数据在收集用户隐私数据之后,会对用户精准画像,不仅体现在广告的推送上,在日常视频、文章、购物,都会给用户进行相关的喜好的推荐,这些也无可厚非,但是在推荐这些内容的时候,相关企业都会掺杂私货,也就是在某几条内容中夹带盈利性质的广告。
而这些掺杂的广告大多数都属于三无产品,因此对于用户而言,购买其产品没有任何的保障。过去的魏则西事件,则是这种情况下典型的受害者。由于轻信了网站上推荐的医院广告,导致病情被耽误,最后病逝,这也是大数据没有得到有效监管的一个案例。
让数据的归属权回到用户手中
如果将区块链运用到大数据当中,魏则西这样的悲剧显然是能够避免的。用户通过区块链可以对自己的隐私数据进行跟踪、溯源,因此这种软文推送的权利掌握在用户自己手中,并且可以一眼就辨别哪些是软文,哪些又是真正的优质内容。
对于企业而言,把数据上传至区块链当中,这些数据会形成链条,具有真实、顺序、可追溯的特性,相当于已经从大数据中把有效数据进行了分类整理,也降低了企业对大数据处理的门槛,能够更快、更好的提取更多有利数据。
确切来说,区块链与大数据是一对相得益彰的伙伴,在收集数据上,区块链没有大数据如此擅长,而在数据安全上,大数据也没有区块链这般稳固。大数据的蓬勃发展也会相对带动区块链的进步,两者相辅相成,才会更好的为社会服务。
也许终有一天,我们可以完全掌握自己的信息,我们可以随意的查看我们真正想要的内容,不会在网上受到欺骗,不会在网络上被人带跑三观。届时,我们将在网络中找到最真实的自我。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01