【发布时间】:2020-03-30 15:28:48
【问题描述】:
我有两个不同的重复名称的单独 csv 文件,我想删除重复的名称并将它们导出到 csv 中,仅识别重复的名称。
csv_file1:
first_name, last_name
lucas, micker
kyle, smith
mark, davis
danny, green
myles, cook
csv_file2:
first_name, last_name
corey, mintzer
lucas, erin
mark, davis
danny, green
myles, turner
预期输出:
first_name, last_name
mark, davis
danny, green
这是我不工作的代码。我对熊猫库不太了解,我确定还有其他方法可以做到这一点。
import pandas as pd
a = pd.read_csv('file1.csv')
b = pd.read_csv('file2.csv')
c = pd.merge(a, b, how='inner', on=['first_name', 'last_name'])
c.to_csv('remove_dup_.csv')
非常感谢任何帮助。
【问题讨论】:
-
那应该工作,你能更准确地说什么“不工作”吗?也许这是一个前导/尾随空格问题,或者您的输出中是否有更多重复项?
-
我同意@ALollz 应该可行。
标签: python python-3.x pandas csv export-to-csv