【发布时间】:2018-12-05 04:37:30
【问题描述】:
我的背景是什么:
- 如您所知,Chrome、Firefox、Safari 上的网站 HTML 结构有很大不同。因此,当我使用 CSS-Selector 从 HTML 结构中获取元素标签中的数据时,有时该标签已在 Chrome 浏览器中具有,而另一个则没有。因此,我只想专注于一个浏览器以减少工作量。
- 当我使用Scrapy框架从url爬取数据时,我不知道Scrapy会使用哪个浏览器来爬取数据。因此,我也不知道返回什么样的 HTML 响应体。我检查了响应,发现有时结构与从 Chrome 获取的结构相同,但有时却不是。 Scrapy 框架似乎使用了许多不同的网络浏览器来抓取数据。
我想要什么:
- 我只想用 Chrome 浏览器抓取 Scrapy 框架中的数据
- HTML 响应正文的结构必须从 Chrome 获取
我问什么:
- 有没有人有任何想法或提示可以帮助我处理这个问题?
- 我可以像 Selenium 那样在 Scrapy Framework 中配置 Webdriver 吗? (如果可能,请告诉我在哪里以及如何?)
谢谢!
【问题讨论】:
-
欢迎来到 Stack Overflow!请查看writing the perfect question 以帮助您提出一个好问题,从而得到一个好的答案。
-
好的,谢谢,我会改进的。
标签: python selenium web-scraping scrapy web-crawler