【发布时间】:2020-07-17 19:30:01
【问题描述】:
我正在尝试让 selenium 使用 CSS 选择器抓取 wiki 页面的第一段。
当我运行这段代码时,它似乎只从原始网页中选择了一些
而不是我要搜索的内容,在本例中为“猫”。
对此的任何帮助都会很棒!
browser = webdriver.Firefox(executable_path='D:\Import Files that I also want backed up\Jupyter Notebooks\Python Projects\Selenium\driverss\geckodriver.exe')
browser.get('https://en.wikipedia.org')
search_elem = browser.find_element_by_css_selector('#searchInput')
search_elem.send_keys('cats')
search_elem.submit()
results_elem = browser.find_element_by_css_selector('p')
print(results_elem.text)
output:
Adventure Time is an American fantasy animated television series created .....
【问题讨论】:
-
你的预期输出是什么?
-
我想打印“猫”页的第一段。但是当使用 css 选择器时,我仍然只是刮掉第一个 'wikipedia.com' 页面。即使我在“猫”页面上。本质上,我希望能够在使用 selenium 搜索主题后从网页中抓取。
标签: python css selenium web-scraping webdriverwait