【发布时间】:2020-03-30 03:16:29
【问题描述】:
我从来自 selenium 请求的 json 正文中选择了 results。我想摆脱标题和结果的第一列。尝试了 pandas 的一些方法,似乎对我不起作用。
这是我尝试过的
driver.get('https://reversewhois.domaintools.com/?ajax=mReverseWhois&call=ajaxUpdateRefinePreview&q=%5B%5B%5B%22whois%22%2C%222%22%2C%22VerifiedID%40SG-Mandatory%22%5D%5D%5D')
time.sleep(5)
pre = driver.find_element_by_tag_name("pre").text
data = json.loads(pre)
table = data['results']
tables = pd.read_html(table,header=None)
df = tables[-1]
print(df)
我收到了这样的回复
Domain Name Create Date Registrar
0 001.sg 2019-03-13 WEB COMMERCE COMMUNICATIONS (S) PTE LTD
1 001cafe.sg 2020-01-01 EXABYTES NETWORK (SINGAPORE) PTE LTD
我只想去掉标题和第一列。我只需要域名和其他详细信息。谁能告诉我为什么我的方法不起作用?
【问题讨论】:
-
skiprows参数能解决问题吗?你可以在这里查看详细信息 --> pandas.pydata.org/pandas-docs/stable/reference/api/… -
好的,它工作。但我也需要跳过第一列。
-
你可以使用
del df['column_name'] -
我可以使用
del df[''],因为第一个标题是空白的吗? @dzakyputra -
或
df.drop?你怎么看?
标签: python json pandas selenium