【发布时间】:2020-05-29 13:51:31
【问题描述】:
我需要阅读网页列表。例如,我有一个可以工作的网络
url1 = 'https://www.sia.ch/en/membership/member-directory/m/207778/'
driver = webdriver.Chrome('/Users/massaro/research/Valeria/chromedriver 2')
driver.get(url1)
html = driver.page_source
html = str(html).replace('<br />', '::')
df1 = pd.read_html(html)[0].iloc[[0,2],1]
比我有另一个页面出现错误
url2 = 'https://www.sia.ch/en/membership/member-directory/m/105531/'
driver = webdriver.Chrome('/Users/massaro/research/Valeria/chromedriver 2')
driver.get(url2)
html = driver.page_source
html = str(html).replace('<br />', '::')
df1 = pd.read_html(html)[0].iloc[[0,2],1]
ValueError: No tables found
我想有一个条件跳过没有表格的网页以避免错误。
【问题讨论】:
-
但是你有这样的条件。没有表格的页面将引发
ValueError。这是一个可测试的条件。 -
@usr2564301 是的,但我怎样才能在得到错误之前检查它?
-
“之前”,不,你没有。捕获错误是 standard procedure in Python。
标签: python web-scraping