【发布时间】:2021-02-12 21:40:19
【问题描述】:
试图从www.currys.co.uk 那里获取智能手表的重量。该网站并未对所有产品采用相同的结构,因此为了获得每种产品的权重,我尝试使用 xpath 进行关键字搜索:
//text()[contains(.,'Weight')]
我可以得到文字“重量”,但我想得到的是下面node那个contains重量的实际值:
<tbody>
<tr>
<th scope = "row">Weight</th>
<td> 26.7 g</td>
<tr>
<body>
我正在寻找的是获取文本26.7 g。我尝试使用以下方法,但它似乎不起作用:
//text()[contains(.,'Weight')]//td
有什么建议吗?提前致谢。
【问题讨论】:
标签: xml web-scraping xpath scrapy contains