人工智能与机器学习有哪些不同
人工智能早已不是一个新名词,它的发展历史已经有几十年。从80年代早期开始,当时计算机科学家设计出可以学习和模仿人类行为的算法。在学习方面,最重要的算法是神经网络,但由于模型过于强大,没有足够的数据支持,导致不是很成功。然而,在一些更具体的任务中,使用数据来适应函数的想法获得了巨大的成功,这也构成了机器学习的基础。在模仿方面,人工智能在图像识别、语音识别和自然语言处理方面有着广泛的应用。专家们花费了大量时间去创建边缘计算,彩色型材,N-gram语言模型,语法树等,不料所获成绩平平。
传统的机器学习
机器学习(ML)技术在预测中发挥了重要作用,机器学习已经经历了多代,有一套完备的模型结构,如:
·线性回归
·Logistic回归
·决策树
·支持向量机
·贝叶斯模型
·正则化模型
·集成模型
·神经网络
每一个预测模型都基于一定的算法结构,参数可进行调整。训练预测模型涉及以下步骤:
1.选择模型结构(例如,逻辑回归、随机森林等)。
2.用训练数据(输入和输出)对模型进行反馈。
3.学习算法将输出最优模型(即具有特定参数的模型,使训练误差最小化)。
每个模型都有自己的特点,在某些任务中表现很好,在其他方面也却不尽人意。但一般来说,我们可以把它们分为低功耗(简单)模型和大功率(复杂)模型。在不同的模型之间进行选择是一个非常棘手的问题。传统上,使用低功耗/简单模型比使用高功率/复杂模型要好,原因如下:
·在我们拥有大量的处理能力之前,训练高功率模型需要花费很长时间。
·直到我们有一个庞大的数据量,培养高功率模型会导致过拟合问题(由于高功率模型具有丰富的参数,可以适应多种数据的形状,我们可能最终会训练出一个与当前训练数据非常相关的模型,而不是对未来数据进行预测)。
然而,选择低功耗模型存在着所谓的"欠拟合"问题,即模型结构过于简单,无法在较复杂的情况下适应训练数据。(假设下面的数据有一个二次关系:y=5*X的平方;没有方法可以拟合一个线性回归:y=A,B,B,B,无论我们选择什么样的A和B。)
为了减轻"不适合的问题",数据科学家通常会应用他们的"领域知识"来产生"输入特性",它与输出有更直接的关系。(例如,返回到二次关系y=5*X的平方),然后通过选取a=5和b=0,拟合线性回归。
机器学习的一个主要障碍是这个特征工程步骤,它要求领域专家在进入培训过程之前识别重要的信号。特征工程步骤非常手工,需要大量的领域专门知识,因此成为当今大多数机器学习任务的主要瓶颈。换句话说,如果我们没有足够的处理能力和足够的数据,那么我们必须使用低功耗/简单的模型,这需要我们花大量的时间和精力来创建适当的输入特性。这是大多数数据科学家花时间做的事情。
神经网络的回归
在2000年代早期,随着大容量数据时代大量的细粒度事件数据的收集,随着云计算和大规模并行处理基础设施的进步,机器处理能力得到了极大的提高。我们不再局限于低功耗/简单的模型。例如,当今最流行的两种主流机器学习模型是随机森林和梯度增强树。然而,尽管它们都非常强大,并提供非线性模型拟合训练数据,数据科学家仍然需要仔细地创建功能,以达到良好的性能。
与此同时,计算机科学家重新使用了许多层的神经网络来完成这些人类模拟任务。这给新出生的DNN(深度神经网络)在图像分类和语音识别的任务提供了一个重大的突破。
DNN的主要区别是,你可以发出原信号,(例如,RGB像素值)直接到DNN没有创造任何特定于域的输入特征。通过多层次的神经元(这就是为什么它被称为"深"的神经网络),能够自动生成相应的功能,通过各层最后提供了一个很好的预测。这大大节省了"特征工程"的努力,也是数据科学家遇到的一个主要瓶颈。
DNN也演变成许多不同的网络结构,所以我们美国有线电视新闻网(卷积神经网络),RNN(神经网络)、LSTM(长短期记忆)、GAN(生成对抗网络),迁移学习,注意模型…整个光谱被称为"深度学习",这是当今全机器学习界关注的焦点。
另一个关键的部分是如何模仿一个人(或动物)学习。想象一下感知/行为/奖赏周期的非常自然的动物行为。一个人或动物首先会通过感知他或她处于什么状态来理解环境。基于这一点,他或她会选择一个"动作"把他或她带到另一个"状态",然后他或她会得到一个"奖励",如此循环重复。
这种学习方法(称为强化学习)与传统的有监督机器学习的曲线拟合方法有很大的不同。特别是,强化学习的发生非常迅速,因为每一个新的反馈(如执行一个动作和获得一个奖励)立即被发送来影响随后的决定。强化学习已经获得了巨大的成功在自动驾驶汽车以及AlphaGO(下棋机器人)。
强化学习也提供了一个平滑的预测和优化集成,因为它保持一个信念的当前状态和可能的转移概率时采取不同的行动,然后作出决定,哪些行动会带来最好的结果。
与经典机器学习技术相比,深度学习提供了一个更强大的预测模型,通常能产生良好的预测。与经典的优化模型相比,强化学习提供了更快的学习机制,并且更适应环境的变化。
数据分析咨询请扫描二维码
CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01某家企业10个人面试,有9个本科生……如何脱颖而出,除得体的举止和良好的沟通力外,证书成重要筹码,这也是很多人考证的关键所在。
2022-04-14