Python Pandas中DataFrame.drop_duplicates()删除重复值详解-编程学习网

语法

df.drop_duplicates(subset = None,
                   keep = 'first', 
                   inplace = False, 
                   ignore_index = False)

参数

1.subset:指定的标签或标签序列，仅删除这些列重复值，默认情况为所有列

2.keep:确定要保留的重复值，有以下可选项:

first:保留第一次出现的重复值，默认

last:保留最后一次出现的重复值

False:删除所有重复值

3.inplace:是否生效

4.ignore_index:如果为True，则重新分配自然索引(0,1,…,n - 1)

# 删除重复值 DataFrame.drop_duplicates()
import pandas as pd
 
df = pd.DataFrame([['x','x',1],['x','x',1],['z','x',2]], columns = ['A','B','C'])
 
# 删除重复行
res1 = df.drop_duplicates()
 
# 删除指定列
res2 = df.drop_duplicates(subset = ['A'])
 
# 保留最后一个
res3 = df.drop_duplicates(subset = ['A'], keep = 'last')

结果展示

res1

res2

res3

扩展:识别重复值

import pandas as pd
 
df = pd.DataFrame({
    'studentID':['A001','A002','A003','A004','A005','A006','A006'],
    'score':[100,93,94,96,93,95,95]})
 
# 识别重复值
duplicate_value = df[df.duplicated()]

由上图可知studentID为'A006'的记录有两条，我们可以使用duplicated()方法识别重复值，它返回的是布尔值结果(True:有重复值，False:无重复值)

duplicate_value

总结

到此这篇关于Python Pandas中DataFrame.drop_duplicates()删除重复值的文章就介绍到这了,更多相关Pandas DataFrame.drop_duplicates()删除重复值内容请搜索编程网以前的文章或继续浏览下面的相关文章希望大家以后多多支持编程网！

文章详情

Python Pandas中DataFrame.drop_duplicates()删除重复值详解

目录

语法

参数

结果展示

扩展:识别重复值

总结

软考中级精品资料免费领

相关文章

猜你喜欢

Python Pandas中DataFrame.drop_duplicates()删除重复值详解

Python Pandas中DataFrame.drop_duplicates()怎么删除重复值

python怎么删除列表中的重复值

Python pandas找出、删除重复的数据实例

php删除数组中的重复值

怎么使用Python pandas找出删除重复的数据

php如何删除数组中的重复值

在 PHP 中从数组中删除重复的值

Python Pandas中缺失值NaN的判断,删除及替换

详解如何使用Python实现删除重复文件

postgresql 删除重复数据案例详解

python使用set函数删除列表的重复值

Python实现删除重复视频文件的方法详解

Python中字典列表中删除重复项

php如何删除数组中重复的元素值

Python怎么删除列表中重复元素

Python如何删除列表中重复元素

python如何删除列表中的重复元素

python怎么删除数组中重复的元素

python怎么删除矩阵中重复的元素