drop_duplicates 去重 对0的操作
时间: 2023-10-09 08:07:47 浏览: 76
Python DataFrame使用drop_duplicates()函数去重(保留重复值,取重复值)
5星 · 资源好评率100%
如果您想对某一列中特定值进行去重操作,比如对值为 0 的行进行去重,可以通过指定 subset 参数来实现。
以下是一个示例代码:
```python
import pandas as pd
# 创建一个包含重复值的 DataFrame
data = {'col1': [1, 2, 0, 3, 4, 0, 5],
'col2': ['a', 'b', 'c', 'd', 'e', 'f', 'g']}
df = pd.DataFrame(data)
# 使用 drop_duplicates() 去除特定值为 0 的行
df_drop_duplicates = df.drop_duplicates(subset=['col1'], keep='first')
print(df_drop_duplicates)
```
在上面的示例中,我们使用 subset 参数指定了要进行去重操作的列为 'col1',并且通过 keep 参数设置了保留第一次出现的重复值。
输出结果如下:
```
col1 col2
0 1 a
1 2 b
2 0 c
3 3 d
4 4 e
6 5 g
```
这样就只保留了第一次出现的值为 0 的行,其他重复的行都被删除了。
希望这个示例能够满足您的需求!如果有任何其他问题,请随时提问。
阅读全文