热线电话:13121318867

登录
2020-05-31 阅读量: 642
异常值如何识别?

异常值也称为离群点,就是那些远离绝大多数样本点的特殊群体,通常这样的数据点在数据集中都表现出不合理的特性。

如果忽视这些异常值,在某些建模场景下就会导致结论的错误(如线性回归模型、K均值聚类等),所以在数据的探索过程中,有必要识别出这些异常值并处理好它们。

通常,异常值的识别可以借助于图形法(如箱线图、正态分布图)和建模法(如线性回归、聚类算法、K近邻算法)等多种方法。

14.0376
0
关注作者
收藏
评论(0)

发表评论

暂无数据
推荐帖子