【发布时间】:2020-04-14 05:02:11
【问题描述】:
我正在使用scrapy shell提取以下网页的数据:
https://www.apo-in.de/product/acc-akut-600-brausetabletten.24170.html
大多数数据都有效,但下部有一个表格,其中内容(例如 PZN)我似乎无法提取。
scrapy shell
fetch('https://www.apo-in.de/product/acc-akut-600-brausetabletten.24170.html')
>>> response.xpath('//*[@id="accordionContent5e95408f73b10"]/div/table/tbody/tr[1]/td/text()').extract()
返回:[]
我还下载了该页面以供scrapy看到它:
scrapy fetch --nolog https://www.apo-in.de/product/acc-akut-600-brausetabletten.24170.html > test.html
虽然它在 HTML 中看起来不错,虽然我可以在 chrome 中抓取它,但它在 scrapy shell 中不起作用。
如何检索这些数据?
【问题讨论】: