京公网安备 11010802034615号
经营许可证编号:京B2-20210330
导致人类而非机器人成为数据科学关键的原因有哪些
科幻小说中经常把人类的未来想象成人工智能将会有至高无上的统领权,并且取代人类,完成人类一切可以完成的事情。坦率地讲,当这样的科幻场景开始引入科学技术的时候,并没有太多的好处,因为它会让人类对于“什么样的人会做好事”和“类似深度学习的其他什么样的高科技可以做得更好”这两个问题失去专注能力。
在数据科学世界的深度学习领域当中,我们正在大跨步的向前迈进。我们已经取得了如此巨大的进步,以至于人们会有这样的想法:我们不需要欣然接收数据科学的那些繁文缛节,取而代之的是我们只要再稍微等一下,我们就可以拥有类似Waston这样的盒子来为我们执行一切事务。如果你真是如此设想的话,那么你将要错失良机,接下来就是其中的原因。
1. We Dole Out the Work 人类可以派发工作
深度学习以及大部分的数据科学技术,他们的任务处理能力都被限制在一个相对狭隘的范围内。深度学习一词是对于目前阶段机器学习的最高级形式的一种描述。机器学习作为一个程序系统,其目的就是通过对采用多种统计与算法技术的基于原始数据的复杂模式的观察,发现其中你想要的数据。深度学习技术在图像识别或者其他数据集的某些特性方面以及对于感知任务的有效处理能力,得到了广泛地验证。大多数情况下,你可以将庞大的处理过程化解为一个更加简单的模型,这样你就可以预测出某些事情,而且可以从中找到某些隐藏的提示。深度学习技术的成功代表作包括翻译(比如谷歌翻译和百度翻译)和语音识别(包括苹果手机的Siri和Google Now功能),也包括图像识别,甚至还可以玩视频游戏以及放飞直升机模型。
如今,我们没有理由不为深度学习取得的胜利成果欢呼雀跃。但是迄今为止,深度学习系统也能把一些专业化任务完成的很漂亮,而绝非仅仅能够懂得特定情况下的事务。Zachary Chase Lipton曾经发表了一篇博文,该博文的内容主要是调查了各种指出深度学习系统存在破绽的论文。博文的调查结果证明深度学些系统大都是不堪一击并且能被轻而易举地愚弄。深度学习的关键点在于它懂得什么时候这种技术可以运行,什么时候不运行。
2. We Provide Context 人类提供了场景
无人驾驶汽车本身不知道自己开向哪里也不知道为什么要这么做。我们需要人类提供场景,来形成日常遇到的问题,形成假设的前提并且决定运用什么样的深度学习和数据科学。即使当今大多数的先进系统都还是只能把一件任务做得非常完美的“白痴学者”,但是这种系统本身根本不会为自己提供更宽广的情景。
在任何一种机器学习或者分析问题的领域内,人们所扮演的最重要的角色之一就是决定目标是什么。建立一个可以优化价值的系统很容易,但是结果却发现你一开始打算解决的问题就选错了。在接下来相当长的一段时间内,人类仍旧是唯一的确定难题的主体,也只有人类才能知晓什么才是真正重要的事情,并且可以核实系统是否能够像我们所期待的那样在面对问题领域的直觉理解时发挥预期的功能。
高级系统不知道应该何时将他们自己关闭。在2008年的经济危机之后,人们选择关闭很多交易系统项目,因为人们对这些系统所做的假设条件都没有起到任何帮助作用。在任何情况下,作出关于生死抉择的提议或者带有关键性经济后果的系统往往都是需要人类进行监管、改进并且其决定由人类进行批准的白盒系统。
3. You Can’t Buy Deep Learning 你无法购买深度学习技术
深度学习以及数据科学技术的服务产品化过程不会很快到来。丰田汽车公司将要为应用到无人驾驶汽车技术的深度学习投资十亿美元。到目前为止,无人驾驶汽车并未使用太多的深度学习技术。Google和Facebook正急于将深度学习技术产品化,但是大多数仍旧处于研发阶段。这一切看起来前途似锦,但还是让我们直面现实吧:大多数美国人都在电视上看到过Woston的商业广告,而不是Woston掌权的产品。
在深度学习和数据科学领域内,真正赢家是那些懂得这些强大工具本身的限制并且可以通过正确的方法利用他们去探索未知世界的公司。那些拥有数据科学技能的聪明人,才是让你立即或者在未来迈向成功的关键所在。
数据科学和机器学习的世界总是让人感到兴奋并将不断的壮大。诚然,我们必须意识到机器学习仍旧需要借助人类的维护和监察才能获得成功。我们必须持续加强并整合商业机构当中的数据科学部门,以便于让机器和机器之间有更加畅通的交流。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】软件、洞察力、大数据、产品、经验、硬件、流量、创新、决策、数据安全、网络安全、数据分析、决策制定、数据挖 ...
2026-06-18在方案选型、效果复盘、产品评估、供应商筛选等各类业务决策场景中,仅凭单一指标下结论往往会陷入 “以偏概全” 的误区。多维度 ...
2026-06-18 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-06-18在数据分析、用户运营与业务增长的工作体系中,漏斗拆解是最基础也最高频的问题定位方法。很多业务场景下,我们只能看到最终的转 ...
2026-06-17在数据库开发、数据清洗与报表统计场景中,数值类型转换为日期是高频刚需操作。业务系统常以 Unix 时间戳、整型日期(如20240617 ...
2026-06-17 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-06-17【核心关键词】数据库、电商、知识、产品、数据产品、监管业务、产品经理、业务系统、用户行为分析、用户分析、数据分析、电商 ...
2026-06-16在 Python 动态类型与面向对象的编程体系中,变量定义与类实例化是构建代码逻辑的两大核心基石。变量是数据存储、传递与运算的基 ...
2026-06-16 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据和表结构数据有什么区别”“数据类型误判会引发哪些分析错误” ...
2026-06-16在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10