【发布时间】:2019-08-21 19:45:36
【问题描述】:
我正在从一个网站下载多个报告。每个报告都有自己的 URL。一些 URL 加载正常,没有问题。
但是有一个 URL 会产生以下错误。除查询参数外,所有 URL 都具有相同的模式。如果我在浏览器上打开 URL,它可以正常工作。
我正在使用 Selenium 和 Firefox 驱动程序。
下面是我的代码
if __name__ == "__main__":
firefox_options = Options()
#firefox_options.headless = True
driver = webdriver.Firefox(options=firefox_options, executable_path=firefox_driver_location)
logged_in = "no"
for query in sa360_query_array:
print("query being processed is " + query )
if "270348" in query or "269756" in query:
wait_time = 300
else:
wait_time = 15
driver.get(query)
print("Page wait time is " + str(wait_time))
driver.implicitly_wait(300000)
#print(driver.page_source)
if logged_in !="yes":
google_login(query,email_login,email_password) #This function logs into google account
print("Sleeping 200 seconds")
time.sleep(200)
logged_in = "yes"
#time.sleep(200)
print("reading HTML")
#print(driver.page_source)
read_web = pd.read_html(driver.page_source)#The error occurs on this line
那个错误也指的是什么?
【问题讨论】:
-
用文本格式的错误堆栈跟踪更新问题。
标签: python selenium firefox marionette geckodriver