【发布时间】:2021-09-24 01:28:56
【问题描述】:
我希望查找网站中的所有图片,而无需点击每张图片。例如,第一页包含一堆图像,单击第一张图像并转到带有故事/图像的另一个页面。检索图像/文本等。
感兴趣的网站是:https://www.homestolove.com.au/australian-house-and-garden。
我发现所有图像 xpath 都以 /img 结尾,如下所示。是否可以使用 Selenium 来做到这一点?我可以使用正则表达式搜索页面吗?由于 JS 内容而使用 Selenium。
xpath //*[@id="app"]/div/div/div[3]/div/div[1]/div[1]/section/div/div[1]/div[3]/article[3 ]/div/a/span/图片/img
或者我需要点击每个页面,有点痛苦。
这通常是怎么做的?
谢谢。
【问题讨论】:
-
好吧,所有的图片都在
<img>标签中,所以xpath必须以img结尾,但是你只能点击用<a>标签包裹的图片。您应该能够让 Selenium 将所有<img>标记返回给您,而无需完整的 xpath。而且您只能获取您知道 URL 的图像,这意味着您必须获取每个页面。curl和wget可以一次镜像整个网站,包括所有图像。