京公网安备 11010802034615号
经营许可证编号:京B2-20210330
古往今来,人类一直在探求科技的极限。随着信息技术在21世纪的爆发,数据科学与人工智能技术迎来自己的春天,尤其是以深度学习为基础的人工智能技术可谓是大放异彩,在诸多领域远胜人类,并且如人脸识别这样的技术也纷纷落地,甚至悲观者认为,机器智能时代来临,倘若某天机器有了自主思维,人类将会面临灭顶之灾。可是,深度学习就如此无所不能吗?答案是否定的!深度学习是利用深层神经网络的技术,虽然在图像识别等方面已经能够超越人类,但是它仍然有许多方面是不能完成的,本文列举深度学习目前不能实现的一些领域,希望能够帮大家打开思维,更好地认识深度学习。
既是学霸,又是游戏王
一般来说,多数人每年可以看300篇文献,而IBM的Watson系统在10分钟里就可以阅读2000万的文献,显而易见,深度学习的学习能力是远远大于人类的,是个十足的“学霸”。与此同时,在游戏领域,不管是围棋还是dota2,深度学习有足够的能力碾压人类。所以深度学习既是学霸,又是游戏王。
多才多艺
下棋,写诗,作曲,艺术画······2016年,阿尔法狗大胜李世石,2017年微软小冰出版第一部诗集,随后又开始转向音乐创作·····深度学习已经慢慢变成琴棋书画样样精通,多才多艺全能王。
从深度学习所取得的成果来看,它似乎已经无所不能,在诸多方面超过了人类。
算法输出不稳定,容易被攻击
在图像识别领域,我们可能在一张图像中只改变一个像素点的值,那么输出结果会发生巨大改变,这就是算法输出不稳定导致的,这种细微的改变在人类看来微不足道,对于算法模型来说确不同。不仅在图像领域,自然语言处理领域也有这样的问题。在问答系统中,在原始文本中随机得加入一些简单的词,模型的理解能力大大降低。这种问题不仅出现在深度学习,传统机器学习更容易被攻击。
模型复杂度高,难以纠错或调试
在2016年阿法狗与李世石的大战中,李世石赢了一局。在李世石的78手后,阿法狗的胜率便直线下降。如果可以投降的话,那么在李世石的第78手后,阿法狗应该会选择投降,而并不会针对这一手进行相应的改进。此外,在深度学习进行翻译时,不管是给模型什么数据输入,都会有一个有意义的输出。此前的谷歌翻译曾遇到过这样的问题,在翻译结果有明显错误的时候,翻译部门的工程师也很难去对模型修改,可见深度学习模型的复杂。
层级复合程度高,参数不透明
在图像识别领域,我们在模型的中间层中尽力去抓取图像的特征。在第一层的卷积层计算后,我们对结果进行可视化,可以很容易看出结果与原图像有很大相似性。然后,随着层数的加深,对中间其他层的可视化,我们完全不能看出中间层所代表的意义。主要原因在于感受野的复合,而且每层的卷积核也会产生复合,加上一些模型会有自己特有的复合,如inception模块的复合,残差的复合,让我们难以从中间层的可视化中看到模型具体运行的结果。
对数据依赖性强,模型增量性差
深度学习是端到端结构,灵活性非常低。我们将单个图像拼接在一起,人类很容易识别的内容,深度学习确无能为力,可见其迁移能力较差。在“语义标注”和“关系检测”这类问题中,人类可以通过完成一个任务中的多个子任务,并将子任务整合的方式解决问题,而对于深度学习来说,多个子任务与一个总任务是完全不同的两个任务,需要不同的模型去解决问题。在数据量较小的情况下,模型拟合能力较差。
专注直观感知类问题,对开放性问题无能为力
我们小时候都曾学习过关于乌鸦喝水的故事。乌鸦在面对半瓶水,而自己的嘴够不着水时,会往瓶子里丢入石子,使得水面上升从而喝到水。此外,乌鸦在无法拨开坚果时,它会把坚果丢在马路上,让来往的车辆碾压从而迟到果实,在此过程中,乌鸦能够通过观察人行道的情况学会判断车辆是否会行驶以保障自己的安全。而鹦鹉也有自己的智能,在听过人类重复说过的话后,鹦鹉能够很好地模仿人类说话。深度学习只能做到鹦鹉的智能,而做不到乌鸦的智能,可见其泛化能力之低。此外,深度学习也难以理解图像背后的寓意。当一幅图中出现奥巴马与一群大象时,深度学习仅仅能辨认图中是一个男人与一群大象,显然图作者却是想透过图片暗喻美国的两党之争,一般来说,大象喻指美国民主党。
机器偏见难以避免,人类知识难以有效监督
这可能是目前深度学习面临的最大问题。数据是深度学习的基础,而数据的可靠程度决定了模型的可靠程度。微软层开发聊天机器人Tay,模仿年轻网民的语言模式。但是试用24小时后便被引入歧途,成为偏激的种族主义者,甚至发出了“希特勒无罪”的消息。原因在于年轻的网民本身的语料库并不是纯净的,是人就会有偏见,这种偏见在网络中尤其严重,这样便导致了Tay用来训练的数据带有偏见,并使得Tay误入歧途,而人类知识的监督很难有效采用,这就无法避免机器的偏见。另一个例子,美国法院用以评估犯罪风险的算法COMPAS,也被证明对黑人造成了系统性歧视。机器偏见无法消除,日后可能会给人类带来严重的后果。
不可否认,深度学习可以在特定领域超过人类,有很好的效果,但它并非万能。某种意义上说,它离智能还差很远。目前,对深度学习的泛化性与可解释性的呼声越来越高。2017年7月,国务院在《新一代人工智能发展规划》中提出“实现具备高可解释性,强泛化能力的人工智能”。或许下一代人工智能技术还是在深度学习基础之上展开,但是希望新的技术能够很好地解决现在深度学习的不能,更好地造福人类!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】数据库、电商、知识、产品、数据产品、监管业务、产品经理、业务系统、用户行为分析、用户分析、数据分析、电商 ...
2026-06-16在 Python 动态类型与面向对象的编程体系中,变量定义与类实例化是构建代码逻辑的两大核心基石。变量是数据存储、传递与运算的基 ...
2026-06-16 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据和表结构数据有什么区别”“数据类型误判会引发哪些分析错误” ...
2026-06-16在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08