
大数据这词,我们并不陌生,它的本意是指从海量的数据中,发现有价值的规律,并为人们所用。比如说,前不久支付宝发布的用户“十年账单”,实际上就是一次大数据在商业领域的应用。
当然了,大数据不光只用在淘宝上,在生活中的方方面面都会涉及。今天,在北京举办了一场声势浩大的科技会议,全世界最顶级的大数据公司云集于此,一起分享大数据在现代生活中的各种应用。接下来,我们一起来听听中外企业对大数据的运用,到底达到了什么样的水平了?
首先来听听国外企业。wandisco是一家硅谷的创业公司,主要做医院大数据的信息整合,目前公司已在伦敦证交所上市,今年刚刚进入中国市场,总经理张涛告诉记者,在美国,他们公司做的大数据产品主要针对患者。比如说,有些患者的病容易复发,他们可以通过大数据,精准的预测患者何时复发。
张涛:比如说我们在美国的医院里面,已经做了一个完整地一体化电子病历和整体的大数据医疗行业应用,他们能够更好地预测病人的二次入院时间。以前病人可能在治疗之后,有一个问题是之后可能会复查,之后可能会复发,那我能不能预计一下哪些病人可能在哪些时候有高发的可能性,主动通知他们,而不要等他们发病以后再来。
张涛说,这款大数据应用,对于国内的医生很受用。为什么呢?因为国内的医生每天要看很多的病人,时间很紧张,很难对病人有一个细致的了解。而大数据的运用,则可以大大的提高诊疗效率。
张涛:医生也会更加舒服,因为他也会提前知道,我今天会有哪个病人会进来,这个病人他的上一次治疗在什么时候做的。他会有一个更完整的记录,而不会每一次都是单纯的谈话,这样会影响效果。而我们在美国做的这个案例,是所有的历史记录无论是详细的片子、治疗等等,无论是在这个医院,还是在其他医院,都整合在一个医院里,全部电子化。所以病人不需要出具任何的东西,医生已经全有你的档案,甚至可能是在你来的前一天医生都已经看过了,这样整个效率都得到了提升。
大数据是行业趋势,不光是国外企业,国内企业也相当重视。在今天的会场上,记者还遇到了专做大数据可视化系统的数字冰雹信息公司总经理邓潇。当着记者的面,邓潇演示了他们的可视化系统,通过环保部的公开数据,把全国100多个重点城市的污染情况在屏幕上有了非常直接的呈现。
邓潇:做数据可视化的话,最主要的价值是帮助人们整体把握和驾驭这种大规模的数据。你现在看到的北京市从“优”“良”“轻度污染”“中度污染”“严重污染”全都有,只有“严重污染”的均值略低过全国的所有城市。所以说非常简单的数据可以让你得出非常非常多的结论。然后可以让你按照不同的维度,并且按照不同的指标,跨纬度,跨指标。分析其中的关系并且做出判断。
尽管大数据广泛运用于生活中的方方面面,能够帮助我们寻找到数字背后的规律。但也有专业人士提醒我们,大数据是一把双刃剑,如果管理不慎,它可能会泄露我们的隐私。启明星辰公司副总裁潘柱廷:
来潘柱廷:举个例子说,大家可能会把自己喜欢的照片晒到网上去。比如说小孩做了什么活动,幼儿园怎么样。他其实完全可以把你小孩是在哪个幼儿园,他现在几岁,他老师叫什么,你家长是什么名字,你家长是什么工作的。那这些是有一定的危险性的。所以我们尽量不要晒未成年尤其是小孩的内容。
在今天的会场上,来自美国卡内基梅隆大学计算机技术教授邢波谈到了一个话题:大数据产生了,有人收集了,但他们会互相分享吗?如果不分享,这些大数据还能起到该有的作用吗?
邢波透露,在美国对于大数据的公开标准,有一个严格的界定。
邢波: 一种是所谓的社会知情权,对政府的一些决策、一些经济数据是不是要公布涉及到安全问题;另一种是为了科学使用这样的大数据,用户的数据、科学数据、天文望远镜照了很多星星的照片、或者生物里面很多DNA的生物的数据,在美国我想他是有一个严格界定的。凡是你用公共部门产生的数据,你有义务把他公布,政府也会提供资源让你去公布,比如有一个地方让你可以存、可以放。但是对于公司的话,他有时就要求公司有权利保护自己的数据。
同样的问题,在国内也存在。中国工程院院士李国杰说,院校的大数据研究要落后于企业,为啥?就是因为院校没有数据,而企业有数据;与此同时,国家很多数据也都不公开,导致无米下锅的状态。
李国杰:但是你要大家把希望都寄托在百度、腾讯这些大公司把数据公开,这个不现实。人家花钱的,人家建平台几十亿几十亿的建立,白干了,公司指着什么花呢。国外也不是这个样子的,公司有公开一些觉得对大家有帮助的触及科研工作,这个他可以做到。你让他把所有的东西都拿出来,那他赚什么钱,所以这些东西我们也没必要太苛求这些。
因此,中科院计算机所研究员程学旗建议,数据公开可以先在政府部门内部搞起来,但是目前,即便是各个部门之间,也都是有很多壁垒。比如智慧交通、智慧医疗的建设,如果有了部门间信息的共享,那效果会有很大改观。
程学旗:其实有很多,比如说我们这个智能交通的管理。第二如果我们把城市的一些数据比较好的关联起来,其实在上面做方法、做运用、做决策、甚至城市规划这块,其实我们可以很好地走近一步,但是恰恰在一个城市里面,各委办局,各个行业部门的数据就没办法把他整合在一起,一个目标驱动的情况下都很难做,这是我觉得大数据落地面临的第一个公职上的大的难点问题。
本文来源:CDA数据分析师培训官网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29