【发布时间】:2021-10-19 07:57:51
【问题描述】:
我有以下代码用于打开包含我想要抓取数据的页面的“新建”链接(如屏幕截图所示)。它工作正常,实际上点击了链接,但我得到的汤仍然是“流行”下的内容(如屏幕截图所示)。
我做错了什么?
driver = webdriver.Chrome(ChromeDriverManager().install())
driver.get("https://www.homeworkmarket.com/fields/business-finance")
time.sleep(2)
doc = driver.find_elements_by_xpath('//*[@id="wrapper"]/div[2]/div[1]/div[1]/div[3]/div[1]/ul/li[1]/a')[0]
doc.click()
time.sleep(10)
page = driver.page_source
soup = BeautifulSoup(page, 'html.parser')
抓取 href 链接的其余代码:
question_links = soup.find_all(class_='css-e5w42e')
final_links = []
for link in question_links:
if 'href' in link.attrs:
link = 'https://www.homeworkmarket.com' + str(link.attrs['href'])
print(link)
final_links.append(link)
【问题讨论】:
-
你要抓取什么数据?也可以用@回复
-
嗨@cruisepandey,谢谢。我想废弃“新建”部分下的 href 链接。尽管使用 find_elements_by_xpath 查找并单击“新建”部分,但我当前的代码正在执行此操作,但仅适用于“热门”部分。将不胜感激任何帮助
-
好吧,看看下面的答案。
标签: python selenium selenium-webdriver beautifulsoup