【发布时间】:2018-09-12 09:55:45
【问题描述】:
是否有任何 python 库有助于获取与给定正则表达式匹配的 dom 节点的 xpath?
我正在尝试从常见问题页面获取问答对
这是来自 site 的三个不同 xpath 问题
xpath1: /html/body/div[1]/div[2]/div[3]/div[2]/div/div[2]/div/div[1]/div/div[7]/div[1]/a/span
xpath2: /html/body/div[1]/div[2]/div[3]/div[2]/div/div[2]/div/div[1]/div/div[10]/div[1]/a/span
xpath3: /html/body/div[1]/div[2]/div[3]/div[2]/div/div[2]/div/div[3]/div[1]/div[1]/div[1]/a/span
现在让正则表达式是这样的:
/html/body/div[1]/div[2]/div[3]/div[2]/div/div[2]/div/ * / * / * /div[1]/a/span
是否有可能通过python中的某个库获得满足我们构建的正则表达式的所有xpath?
我尝试使用scrapy选择器来获取所有问题,但是在获取答案时失败了,所以我想通过所有问题然后获取他们的答案,为此我想要问题 Xpaths
【问题讨论】:
标签: python-3.x xpath web-scraping beautifulsoup scrapy