【发布时间】:2020-01-23 11:50:00
【问题描述】:
我需要从这个网站上刮取唯一的表:https://core.ap.gov.in/CMDashBoard/UserInterface/eAgriculture/eAgricultureVillagewise.aspx?mandal=Agali&district=Anantapuramu
我用了漂亮的汤和请求,但没有成功。你们能建议我哪里出错了吗?
mandal_url = "https://core.ap.gov.in/CMDashBoard/UserInterface/eAgriculture/eAgricultureVillagewise.aspx?mandal=Agali&district=Anantapuramu"
r = requests.get(mandal_url, verify=False).content
soup = bs4.BeautifulSoup(r, 'lxml')
df = pd.read_html(str(soup.find('table',{"id":"gvAgricultureVillage"})))
我在数据框中收到“找不到页面”。我不知道我哪里错了!
【问题讨论】:
-
分解你的函数,这样你就可以更容易地调试它。
get函数是否返回 200?soup.find(...)等的输出是什么 -
即使在 r 中我也没有得到表值!汤什么也没给我。
-
get函数返回一些文本。但是该文本中没有表格值
标签: python beautifulsoup python-requests