【发布时间】:2021-05-07 20:12:36
【问题描述】:
我有一个这样的 json 文件
{"places": [{"place_name":"123 YOU N ME PRESCHOOL","address":"809 W DETWEILLER DR STE A","city": "PEORIA","state":"IL","zip":"61615","geo_location":"40.78878653,-89.605669034","data": {}},{"place_name":"123 YOU N ME PRESCHOOL","address":"6501 SOUTH 12TH ST","city":"PORTAGE","state":"MI","zip":"49024","geo_location":"42.220381633,-85.646607261","data": {}}, {"place_name": "18144 GLEN TERRACE ST.", "address": "18144 GLEN TERRACE ST.", "city": "LANSING", "state": "IL", "zip": "60438", "geo_location": "41.565952019,-87.556316006", "data": {}}]}
如您所见,前两个“place_name”值相同,我希望将它们打印出来。这是我到目前为止的代码,但我得到的只是一个 Nan。有人可以帮忙吗?
import pandas as pd
places = pd.read_json("test.json")
dfObj = pd.DataFrame(places, columns = ['name', 'address', 'city', 'state', 'zip', 'geo', 'data'])
duplicatedRowsDF = dfObj[dfObj.duplicated(["name"])]
print(duplicatedRowsDF)
这是输出
name address city state zip geo data
1 NaN NaN NaN NaN NaN NaN NaN
2 NaN NaN NaN NaN NaN NaN NaN
我想要的输出只是重复的列的名称
【问题讨论】:
标签: python json pandas dataframe