【发布时间】:2022-11-18 14:16:36
【问题描述】:
我需要网络抓取专家的帮助。我正在尝试从该网站的视频标签中获取 src。当我尝试使用 selenium 或 beautifulsoup4 来捕获它时,它就好像不存在一样。 find_elements 返回一个空列表。这个“//*[@id="player"]/div[2]/div[3]/video”是来自 safari 中检查元素的该元素的 XPATH。我在检查网页时可以看到它,但我无法抓取它。我也尝试使用 find_element("src") 方法但没有成功。它抛出一个异常,说没有找到这样的元素。
这是我的代码:
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.chrome.options import Options
options = Options()
options.headless = True
driver = webdriver.Chrome(options=options)
# Navigate to Url
driver.get("https://anime47.com/xem-phim-chainsaw-man-ep-01/187898.html")
# Get all the elements available with tag name 'p'
elements = driver.find_element(By.TAG_NAME, "iframe")
for e in elements:
print(e.text)
【问题讨论】:
-
你到底需要什么?您的问题与您发布的代码不同,请清楚地发布问题。
标签: python html selenium web-scraping beautifulsoup