前面文章小编简单给大家介绍了泛化能力的一些基础知识,今天给大家带来的是提高模型泛化能力的方法--正则化。
一、首先来回顾一下什么是泛化能力
泛化能力(generalization ability),百科给出的定义是:机器学习算法对新鲜样本的适应能力。学习的目的是学到隐含在数据对背后的规律,对具有同一规律的学习集以外的数据,经过训练的网络也能给出合适的输出,该能力称为泛化能力。简单来概括一下,泛化能力就是一个机器学习算法能够识别没有见过的样本的能力,通俗点说就是学以致用,举一反三的能力。机器学习方法训练出一个模型,我们会希望这个模型不但是对于已知的数据(训练集)性能表现良好,而且对于未知的数据(测试集)也能够表现良好,这就表明这个模型具有良好的泛化能力。在实际应用子中,模型的过拟合(overfitting)与欠拟合(underfitting)能够最直观的体现出泛化能力的好坏。
根据泛化能力强弱,可以分为:
欠拟合:模型不能在训练集上获得足够低的误差;
拟合:测试误差与训练误差差距较小;
过拟合:训练误差和测试误差之间的差距太大;
不收敛:模型不是根据训练集训练得到的。
二、简单介绍正则化
正则化regularization的目标为:模型的经验风险和模型复杂度之和达到最小,即结构风险达到最小。也就是正则化的目的是为了防止过拟合, 从而增强泛化能力。
我们通常将正则化定义为:对学习算法的修改,目的是减少泛化误差而不是训练误差
在训练次数足够多,以及表达形式足够复杂的情况下,训练误差能够无限小,可是这并不代表着泛化误差的减小。相反的,一般情况下,这样会导致泛化误差的增大。最常见的例子是:真实数据的分布符合二次函数,但是欠拟合一般会将模型拟合成一次函数,而过拟合通常将模型拟合成高次函数。根据奥卡姆剃须原则:在尽可能符合数据原始分布的基础上,更加平滑、简单的模型,往往更加符合数据的真实特征。所以,我们必须采用采用某种约束,这也就引出了的正则化。
三、正则化---提高模型的泛化能力
按策略正则化可以分为以下三类:
(一) 经验正则化:利用工程上的技巧,实现更低的泛化误差,例如:提前终止法、模型集成、Dropout等;
1.提前终止(earlystop)
一种最简单的正则化方法,在泛化误差指标不再提升后,提前结束训练
2.模型集成(ensemable))
通过训练多个模型来完成该任务,这些模型可以是不同的网络结构,不同的初始化方法,不同的数据集训练出来的,也可以是采用不同的测试图片处理方法。总结来说就是,利用多个模型进行投票的策略
3.Dropout移除一部分神经元
Dropout采用的是"综合起来取平均”的策略,来防止过拟合问题。不同的网络会产生不同的过拟合问题,取平均会让一些“相反的”拟合有互相抵消的可能,整个Dropout过程就相当于 对很多个不同的神经网络取平均。而且因为dropout程序导致两个神经元不一定每次都在一个dropout网络中出现,这样会减少神经元之间复杂的共适应关系
(二)参数正则化:直接提供正则化约束,例如:L1/L2正则化法等;
L1/L2正则化方法,就是最常用的正则化方法,它直接来自于传统的机器学习。
L1正则化:
L2正则化:
(三)隐式正则化:不直接提供约束,例如:数据有关的操作,包括归一化、数据增强、扰乱标签等。
数据分析咨询请扫描二维码
CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2022-03-18CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01