京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代,谁玩得转
《连线》杂志创始主编凯文·凯利说:“不管你现在做什么行业,未来都是数据生意。”“我们正处于整个互联网新时代的第一天。”
类似论断, 11月26日晚,记者在“清华大数据产业联合会”(以下简称“联合会”)成立大会上,也多有耳闻。
这是清华第一个大数据思维碰撞与资源对接平台,由清华数据科学研究院发起指导,依托于清华多个院系和学科在大数据相关领域多年的积累与探索,联合了大数据产业链中的优秀龙头企业与创新企业,旨在促进产、学、研良性互动,共同推动大数据生态系统中的各方合作共赢。清华大学副校长杨斌、清华校友总会TMT协会秘书长邓永强及清华大学相关院系领导出席了此次大会。
又一次IT革命
会长韩亦舜在致辞中说:“大数据这一波浪潮,将给社会带来深刻的变化,诸如多维度的思考、更深刻的洞见、更科学的决策。也许大数据这个词,热一段时间就慢慢冷了,但是我们相信,它给我们留下的是一个新的时代。”
SAS中国研发中心总经理刘政则进一步阐释:“大数据是继互联网之后,又一次IT产业革命。最近20年,先后出现了3个推动经济的引擎,第一个是信息高速公路,第二个是互联网,另一个就是今天的大数据。”
毫无疑问,能令任何商业模式瞬间高大上的“大数据”,眼下正成为最炙手可热的概念。联合会秘书长王霞甚至调侃道:“有相当一部分社会上的人士觉得,大数据已经成功取代‘云计算’,成为下一个最忽悠的词。”
大数据到底是不是“大忽悠”?它正在给我们带来什么改变?
“打个比方,数据犹如沙子。单个来看,也许毫无价值可言;没有技术辨别、提纯的时候,它们就是一盘散沙。但是当数据量足够大的时候,如果有技术能够把它们利用起来,就可以将沙子变成金子。所以最重要的就是要找到淘金的方法,即大数据在各行各业的应用。正如今天一位与会嘉宾所言,如今,无论是面向企业、还是面向个人的市场,都在考虑怎么把沉默的数据变成有价值的源泉。”在发布会现场,联合会发起人之一、起名通创始人张襦心说。
“一加一大于二”
这一切,首先得益于数据大爆炸。
2006年,个人用户才刚刚迈进TB(万亿字节)时代,全球一共新产生了1.8亿TB的数据。而根据知名市场研究机构IDC的统计和预测,2012年数据量已经增长到2.8ZB(十万亿亿字节),到2020年这个数字将超过40ZB,估计是地球所有海滩的沙粒数量的57倍。“信息膨胀的速度和原子弹爆炸的速度是一样的。而这是一个持久的爆炸,远远不是一瞬间。”
如果说以前大多数据是孤立的,如今随着互联网的兴起,这些数据呈现出关联形态的变化,产生“一加一大于二”的价值。
在此次清华大数据产业联合会的成立仪式上,中国统计信息服务中心大数据研究实验室主任江青透露,去年11月,国家统计局与百度、阿里巴巴等11家与大数据相关联的互联网企业成立了一个国家统计局的大数据平台,应用之一即为分析社情民意,提供决策参考。
电子科技大学互联网科学中心主任周涛不久前提到大数据在社科上的应用:“以前做一次实验,比如说探讨宗教问题,我看到最大规模的实验,无非是几百上千人通过问卷的形式表明自己的宗教取向。但是现在我们已经找到有8000多人是有宗教标签的,在微博上也有70多万人,他们分属于不同的教派。通过分析,我们可以了解宗教的不同教派之间是不是有非常紧密的联系,历史上一些彼此不大对头的教派是不是连接比较稀松,他们之间说话、用语到底是用褒义词多还是贬义词多,用有暴力倾向的词多还是比较友善的词多,我们能够宏观地了解哪个教派有最强的反社会倾向等等。”
现代智能的魔力
数据的广泛性、分析方法的先进性,还可以让解决方案更智能。
谷歌利用用户搜索记录,判断美国流感疫情的现状,比疾控中心还要快一两周。今年微软利用大数据,成功预测了第86届奥斯卡金像奖24个奖项中的21个。
在清华大数据产业联合会中,各家企业也都在各自的领域,探索大数据的方向。
曾在华尔街最顶尖的对冲基金D·E·Shaw工作多年的李凌博士,正在实施中国的Kensho——用大数据和人工智能技术,建立全新的量化投资模式,还可以让计算机回答诸如“央行降息对房地产行业有何影响”之类的复杂问题,向人们展示了现代智能的神奇魔力。
在李凌博士看来,除传统的市场行情数据,新型的文本数据(包括互联网新闻和专业的分析师报告)和社交媒体数据也可用于指导投资行为。他领导的团队使用最先进的机器学习算法,不仅能把蕴含在海量数据中的市场信号迅速、准确地抽取出来呈现在投资者面前,还能基于所有信息建立庞大的知识图谱,建立起行业、公司、产品、人、地域、行业指标等之间复杂的关联关系。
张襦心则致力于大数据在文化领域的研究和在现实生活中的落地。2012年,她领导的团队基于覆盖我国超过90%人口的姓名数据,研发出了中国第一个“姓名指数”。如今她正在向人工智能起名领域进一步探索。“如果从前有一个人走过来说,给我起一个名字,必须让我一看就喜欢,我们肯定会认为这是天方夜谭,只有神仙才能猜中他的心思。而通过大数据,就可以让智能起名成为可能。”
从2012年至今,大数据经过铺垫、酝酿、炒作、质疑,如今已经到了走下神坛,真正深入各行各业,将巨大变革之力发挥出来的时候了。从这个意义而言,中国的大数据时代才刚刚开始
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05