热线电话：13121318867

快速解释如何使用pandas的inplace参数

2020-07-22

pandas 是源于NumPy 的一种python库，主要是为了解决数据分析任务而创建的。pandas为我们提供了大量简单便捷地处理数据的函数和方法。今天小编给大家分享的就是：快速解释如何使用pandas的inplace参数，希望对大家学习和使用pandas有所帮助。

以下文章来源： DeepHub IMBA

作者：P**nHub兄弟网站

介绍

在操作dataframe时，初学者有时甚至是更高级的数据科学家会对如何在pandas中使用inplace参数感到困惑。

更有趣的是，我看到的解释这个概念的文章或教程并不多。它似乎被假定为知识或自我解释的概念。不幸的是，这对每个人来说都不是那么简单，因此本文试图解释什么是inplace参数以及如何正确使用它。

让我们来看看一些使用inplace的函数的例子:

fillna()dropna()sort_values()reset_index()sort_index()rename()

我已经创建了这个列表，可能还有更多的函数使用inplace作为参数。我没有记住所有这些函数，但是作为参数的几乎所有pandas DataFrame函数都将以类似的方式运行。这意味着在处理它们时，您将能够应用本文将介绍的相同逻辑。

创建一个示例DataFrame

为了说明inplace的用法，我们将创建一个示例DataFrame。

 import pandas as pd
 import numpy as np
 client_dictionary = {'name': ['Michael', 'Ana', 'Sean', 'Carl', 'Bob'],
                      'second name': [None, 'Angel', 'Ben', 'Frank', 'Daniel'],
                      'birth place': ['New York', 'New York', 'Los Angeles', 'New York', 'New York'],
                      'age': [10, 35, 56, None, 28],
                      'number of children': [0, None, 2, 1, 1]}
 df = pd.DataFrame(client_dictionary)
 df.head()

我们创建了一个数据框架，该数据框架有5行，列如下: name, second name, birthplace,age,number of children。注意，age、second name和children列中有一些缺失值(nan)。

现在我们将演示dropna()函数如何使用inplace参数工作。因为我们想要检查两个不同的变体，所以我们将创建原始数据框架的两个副本。

 df_1 = df.copy()
 df_2 = df.copy()

下面的代码将删除所有缺少值的行。

 df_1.dropna(inplace=True)

如果您在Jupyter notebook中运行此操作，您将看到单元格没有输出。这是因为inplace=True函数不返回任何内容。它用所需的操作修改现有的dataframe，并在原始dataframe上“就地”（inplace）执行。

如果在dataframe上运行head()函数，应该会看到有两行被删除。

 df_1.head()

现在我们用inplace = False运行相同的代码。注意，这次我们将使用df_2版本的df

 df_2.dropna(inplace=False)

如果您在Jupyter notebook中运行此代码，您将看到有一个输出(上面的屏幕截图)。inplace = False函数将返回包含删除行的数据。

记住，当inplace被设置为True时，不会返回任何东西，但是原始数据被修改了。

那么这一次原始数据会发生什么呢?让我们调用head()函数进行检查。

 df_2.head()

原始数据不变!那么发生了什么?

当您使用inplace=True时，将创建并更改新对象，而不是原始数据。如果您希望更新原始数据以反映已删除的行，则必须将结果重新分配到原始数据中，如下面的代码所示。

 df_2 = df_2.dropna(inplace=False)

这正是我们在使用inplace=True时所做的。是的，最后一行代码等价于下面一行:

 df_2.dropna(inplace=True)

后者更优雅，并且不创建中间对象，然后将其重新分配给原始变量。它直接改变原始数据框架，因此，如果需要改变原始数据，那么inplace=True是首选。

那么，为什么会有在使用inplace=True产生错误呢?我不太确定，可能是因为有些人还不知道如何正确使用这个参数。让我们看看一些常见的错误。

常见错误

使用inplace = True处理一个片段

如果我们只是想去掉第二个name和age列中的NaN，而保留number of children列不变，我们该怎么办?

我见过有人这样做:

 df[['second name', 'age']].dropna(inplace=True)

这会抛出以下警告。

这个警告之所以出现是因为Pandas设计师很好，他们实际上是在警告你不要做你可能不想做的事情。该代码正在更改只有两列的dataframe，而不是原始数据框架。这样做的原因是，您选择了dataframe的一个片段，并将dropna()应用到这个片段，而不是原始dataframe。

为了纠正它，可以这样使用

 df.dropna(inplace=True, subset=['second name', 'age'])
 df.head()

这样就可以将dataframe中删除第二个name和age列中值为空的行。

将变量值赋给inplace= True的结果

 df = df.dropna(inplace=True)

这又是你永远不应该做的事情!你只需要将None重新赋值给df。记住，当你使用inplace=True时，什么也不会返回。因此，这段代码的结果是将把None分配给df。

总结

我希望本文为您揭开inplace参数的神秘面纱，您将能够在您的代码中正确地使用它。

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试教材；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试题库；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

▷ 想了解CDA院校合作，点击>>> “院校合作” 了解咨询CDA院校合作；

pandas DataFrame numpy python 数据分析

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇不会绘制环形图？别担心，使用tableau简单几步就能完成

下一篇如何给列表降维？sum()函数的妙用

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

京公网安备 11010802034615号经营许可证编号：京B2-20210330

联系电话：13321103290 (微信同号)

客服在线

立即咨询

客服在线

立即咨询

免密码登录

提交首次登录验证后自动注册

快速解释如何使用pandas的inplace参数

介绍

创建一个示例DataFrame

常见错误

总结

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

【CDA干货】SQL Server 提示“实例已在使用”：常见 ...

【CDA干货】Excel数据透视表两列相乘：正确计算方法 ...

从“模糊需求”到“精确标尺”：CDA数据分析师视角 ...

CDA持证人专访：冯卓基谈大数据平台搭建与行业数字 ...

【CDA干货】基于月度数据的送货率提升专项数据分析 ...

从“样本均值”到“总体真相”：CDA数据分析师视角 ...

【CDA干货】指标：量化业务的核心衡量标准与设计指 ...

【CDA干货】Excel透视表计算字段：先乘法后求和汇总 ...

从“杂乱”到“有序”：CDA数据分析师视角下的数据 ...

CDA持证人专访：崔爱军谈地产行业数据治理与数据中 ...

【CDA干货】显著水平与P值的核心区别、关联关系及实 ...

为什么统计是数据分析师的“底层语言”？ ...

【CDA干货】数据分析核心技能体系：从工具落地到业 ...

【CDA干货】企业价值市场法价值比率与线性回归分析 ...

从“零散明细”到“多维洞察”：CDA数据分析师视角 ...

CDA持证人专访：赵君研谈金融行业数据分析与运营岗 ...

【CDA干货】多维度对比评估：分析逻辑与可视化效果 ...

从“静态数据”到“动态资产”：CDA数据分析师视角 ...

CDA持证人专访：贺译册谈产品经理的市场洞察力与数 ...

【CDA干货】多维度对比评估：分析逻辑与可视化效果 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载