用 Python 编写一个程序来删除给定数据框中的第一个重复行

pythonpandasserver side programmingprogramming更新于 2024/6/22 7:08:17

假设您有一个数据框,删除第一个重复行的结果是,

    Id Age
0    1 12
3    4 13
4    5 14
5    6 12
6    2 13
7    7 16
8    3 14
9    9 15
10  10 14

解决方案

为了解决这个问题,我们将遵循下面给出的步骤 −

  • 定义一个数据框

  • 在 Id 和 Age 列中应用 drop_duplicates 函数,然后将 keep 初始值指定为 ‘last’。

df.drop_duplicates(subset=['Id','Age'],keep='last')
  • 将结果存储在同一个数据框中并打印它

示例

让我们看看下面的实现以便更好地理解 −

import pandas as pd
df = pd.DataFrame({'Id':[1,2,3,4,5,6,2,7,3,9,10],
                         'Age':[12,13,14,13,14,12,13,16,14,15,14]
                  })
print("DataFrame 是:\n",df)
df = df.drop_duplicates(subset=['Id','Age'],keep='last')
print("Dataframe 删除第一个重复行后:\n", df)

输出

DataFrame 是:
    Id    Age
0    1    12
1    2    13
2    3    14
3    4    13
4    5    14
5    6    12
6    2    13
7    7    16
8    3    14
9    9    15
10  10    14
删除第一个重复行后的数据框:
    Id Age
0    1 12
3    4 13
4    5 14
5    6 12
6    2 13
7    7 16
8    3 14
9    9 15
10  10 14

相关文章


有用资源