
我所处的位置决定我看世界的角度。从这里望去,2016 年的分析领域令人振奋。有史以来,分析领域从未如此重要、如此有趣。
1. 机器学习在企业生根发芽
机器学习(Machine learning)的历史可以追溯到 1950 年,但直到最近,它都只是精英人才的领域并长期被人忽视。我预言机器学习会就此稳步发展,因为许多大型企业正在接纳机器学习。如今除了研究者和数字时代原住民,企业也在探索如何把机器学习变为生产力。在一些已经规范化的行业,模型解释性较差,曾导致模型难以应用。如今这些行业的从业者使用机器学习,寻找更多创造性的方法,从模型中选择变量,而这些变量之后能由常用工具进一步构建。机器学习从多个学科中获取营养,所以未来预计会产生更多跨学科的兴趣。回想去年 INFORMS 年会的主题,Dimitris Bertsimas 讲“现代优化视野下的统计与机器学习”( Statistics and Machine Learning via a Modern Optimization Lens )。我的同事 Patrick Hall 也对于“为什么是机器学习?为什么是现在?”(Why Machine Learning? Why Now?)这一话题给出了他的看法。
2. 物联网大潮降温,面对现实
根据 Gartner 公司的新科技周期理论(Hype Cycle)来看,物联网(Internet of Things, IoT)正处在科技周期的顶峰。但在 2016 年我预计物联网这个概念将有所降温,开始面对现实。如何采集是一个很实际的障碍——信息太多了。我的一个同事正在把我们新大楼的HVAC 暖通系统,作为一个物联网测试项目进行分析。这栋楼里到处都是传感器,但获取数据却并不容易。设施部门告诉他这是IT部门的职权,IT部门把他又踢到了制造商那里,因为 HVAC 收集数据之后发送给了制造商。“数据所有权”是一个在逐渐浮现的议题:你生产了数据,却无法获取它。如何证实自己的价值是物联网面对的更大挑战。物联网在企业级的整体生产应用依然有限。物联网给出的承诺无与伦比,所以在 2016 年让我们期待早期使用者们能解决问题,给出答案。
3. 大数据走出喧嚣,让模型变得丰富
大数据已经走出了喧嚣,产生了实际的价值。如今的建模者可以获取的数据种类前所未有地丰富(例如,非结构数据,地理空间数据,图像,声音),而这些数据使得模型可以变得更加丰富。大数据的另一新进展来自各类竞赛,这些竞赛超越了之前游戏化的形式,通过众包和数据分享产生了实际价值。拿前列腺癌 DREAM 挑战为例,参赛队伍使用四种临床诊断的匿名数据挑战开放的临床研究问题。这些数据来源众多,大部分是第一次公之于众。参赛队伍的数目史无前例,最终的获胜者战胜了之前此领域尖端研究者开发的模型。
4. 通过分析提高信息安全
随着物联网发展,传感器的广泛使用肯定让数码空间的犯罪分子感到兴奋。他们使用这些设备,用一种缓慢而低调的木马手段进行劫持。许多传统的侦查手段对此无效,因为侦查不再是寻找一个稀有事件的过程,而需要对情境中事件的累积进行理解。跟物联网一样,信息安全面对的一个挑战和数据有关。我预计先进的分析作为追踪数据的手段,能为侦查和预防做出新的贡献。很可惜,本文无法谈论大数据的合作中正在发展出的方法,因为我们不想让坏蛋知道我们是怎么发现它们的。这方面的许多优秀工作都是在高度安全的隔离环境中完成的。不过,2016 年 SAS 和其他各方仍会高度关注信息安全。
5. 分析驱动着企业与学界加强互动
北卡罗来纳州立大学的高级分析研究所(The Institute for Advanced Analytics, IAA)关注分析领域的硕士项目数量增长。新的硕士项目与日俱增。企业的招聘需求促进了增长,但同时我也看到了它们对于研究的兴趣。越来越多的企业在设立学术扩展部门,并表现出对于研究合作的浓厚兴趣。有时这种兴趣超越合作伙伴关系,转而直接雇佣学界名人。这些学界名人可能是休假期间来工作,或者在学界和企业往返。例如,机器学习顶尖研究者 Yann LeCun 曾在贝尔实验室工作,也曾是纽约大学的教授,曾是建立纽约大学数据科学中心的主管,现在在 Facebook 带领人工智能研究团队。INFORMS(运筹学与管理科学研究协会),通过为学界提供与分析有关的教学材料的方式,支持这种产学互动。2016 年 INFORMS 会为业界提供一个可查询的、分析领域(硕士)项目的数据库以促进双方往来,并提供新的 Associate Certified Analytics Professional 证书来帮助选拔毕业生。
本文来源:简书
转自:中国大数据
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
如何考取数据分析师证书:以 CDA 为例 在数字化浪潮席卷各行各业的当下,数据分析师已然成为企业挖掘数据价值、驱动决策的 ...
2025-07-15CDA 精益业务数据分析:驱动企业高效决策的核心引擎 在数字经济时代,企业面临着前所未有的数据洪流,如何从海量数据中提取有 ...
2025-07-15MySQL 无外键关联表的 JOIN 实战:数据整合的灵活之道 在 MySQL 数据库的日常操作中,我们经常会遇到需要整合多张表数据的场景 ...
2025-07-15Python Pandas:数据科学的瑞士军刀 在数据驱动的时代,面对海量、复杂的数据,如何高效地进行处理、分析和挖掘成为关键。 ...
2025-07-15用 SQL 生成逆向回滚 SQL:数据操作的 “后悔药” 指南 在数据库操作中,误删数据、错改字段或误执行批量更新等问题时有发生。 ...
2025-07-14t检验与Wilcoxon检验的选择:何时用t.test,何时用wilcox.test? t 检验与 Wilcoxon 检验的选择:何时用 t.test,何时用 wilcox. ...
2025-07-14AI 浪潮下的生存与进阶: CDA数据分析师—开启新时代职业生涯的钥匙(深度研究报告、发展指导白皮书) 发布机构:CDA数据科 ...
2025-07-13LSTM 模型输入长度选择技巧:提升序列建模效能的关键 在循环神经网络(RNN)家族中,长短期记忆网络(LSTM)凭借其解决长序列 ...
2025-07-11CDA 数据分析师报考条件详解与准备指南 在数据驱动决策的时代浪潮下,CDA 数据分析师认证愈发受到瞩目,成为众多有志投身数 ...
2025-07-11数据透视表中两列相乘合计的实用指南 在数据分析的日常工作中,数据透视表凭借其强大的数据汇总和分析功能,成为了 Excel 用户 ...
2025-07-11尊敬的考生: 您好! 我们诚挚通知您,CDA Level I和 Level II考试大纲将于 2025年7月25日 实施重大更新。 此次更新旨在确保认 ...
2025-07-10BI 大数据分析师:连接数据与业务的价值转化者 在大数据与商业智能(Business Intelligence,简称 BI)深度融合的时代,BI ...
2025-07-10SQL 在预测分析中的应用:从数据查询到趋势预判 在数据驱动决策的时代,预测分析作为挖掘数据潜在价值的核心手段,正被广泛 ...
2025-07-10数据查询结束后:分析师的收尾工作与价值深化 在数据分析的全流程中,“query end”(查询结束)并非工作的终点,而是将数 ...
2025-07-10CDA 数据分析师考试:从报考到取证的全攻略 在数字经济蓬勃发展的今天,数据分析师已成为各行业争抢的核心人才,而 CDA(Certi ...
2025-07-09【CDA干货】单样本趋势性检验:捕捉数据背后的时间轨迹 在数据分析的版图中,单样本趋势性检验如同一位耐心的侦探,专注于从单 ...
2025-07-09year_month数据类型:时间维度的精准切片 在数据的世界里,时间是最不可或缺的维度之一,而year_month数据类型就像一把精准 ...
2025-07-09CDA 备考干货:Python 在数据分析中的核心应用与实战技巧 在 CDA 数据分析师认证考试中,Python 作为数据处理与分析的核心 ...
2025-07-08SPSS 中的 Mann-Kendall 检验:数据趋势与突变分析的有力工具 在数据分析的广袤领域中,准确捕捉数据的趋势变化以及识别 ...
2025-07-08备战 CDA 数据分析师考试:需要多久?如何规划? CDA(Certified Data Analyst)数据分析师认证作为国内权威的数据分析能力认证 ...
2025-07-08