【发布时间】:2023-03-05 05:52:02
【问题描述】:
我有以下数据框:
import pandas as pd
data = [['1044', '1924'], ['1044', '1926'], ['1044', '1927'], ['1044', '1928'], ['1048', '1924'], ['1048', '1926'], ['1048', '1927'], ['1048', '1928'], ['1051', '1924'], ['1051', '1926'], ['1051', '1927'], ['1051', '1928'], ['1058', '']]
df = pd.DataFrame(data, columns = ['Col1', 'Col2'])
我想减少数据框,如下所示:
我不知道该怎么做,但它应该如下工作:
- 将第一个副本保留在“日期”列中 - 在本示例中为第 0 行
- 在“值”列中删除第二个重复项 - 在本示例中为第 3 行
希望它确实存在一种更简单的方法来执行它。
【问题讨论】:
-
你可以建立一个新的数据框:
pd.DataFrame({key:pd.unique(value) for key, value in df.items()}) -
完美运行。谢谢你。如何在上面的代码中定义这两列?
-
@sammywemmy 聪明人,你应该把它作为答案发布;)
标签: pandas duplicates