【发布时间】:2016-08-04 17:02:42
【问题描述】:
我有一个 page 有一个表(表 id= "ctl00_ContentPlaceHolder_ctl00_ctl00_GV" class="GridListings" )我需要刮。 我通常使用 BeautifulSoup 和 urllib,但在这种情况下,问题是表需要一些时间来加载,所以当我尝试使用 BS 获取它时它没有被捕获。 由于某些安装问题,我无法使用 PyQt4、drysracpe 或 windmill,所以唯一可能的方法是使用 Selenium/PhantomJS 我尝试了以下方法,仍然没有成功:
from selenium.webdriver.common.by import By
from selenium.webdriver.support.wait import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
driver = webdriver.PhantomJS()
driver.get(url)
wait = WebDriverWait(driver, 10)
table = wait.until(EC.presence_of_element_located(By.CSS_SELECTOR, 'table#ctl00_ContentPlaceHolder_ctl00_ctl00_GV'))
上面的代码没有给我想要的表格内容。 我该如何实现这一目标???
【问题讨论】:
-
什么意思没有给我想要的内容??有没有例外??你能在这里分享你的表格 HTML 吗??
-
嗨,link 最下面的表格是我想要的(带有 class="GridListings" 的表格)
-
很抱歉,这次我无法查看表格,这就是为什么我要告诉您在这里分享表格 HTML..
标签: python selenium selenium-webdriver