【发布时间】:2020-07-04 13:54:02
【问题描述】:
目前,在我的代码中,我分解了一个更大的汤以使用此代码获取所有“td”标签:
floorplans_all = sub_soup.findAll('td', {"data-label":"Rent"})
floorplan_soup = soup(floorplans_all[0].prettify(), "html.parser")
rent_span = floorplan_soup.findAll('span', {"class":"sr-only"})
print(floorplans_all)
最终得到以下结果:
<td data-label="Rent" data-selenium-id="Rent_6">
<span class="sr-only">
Monthly Rent
</span>
$2,335 -
<span class="sr-only">
to
</span>
$5,269
</td>
打印rent_span看起来像这样:
[<span class="sr-only">
Monthly Rent
</span>, <span class="sr-only">
to
</span>]
我似乎无法从上面得到“$2,335 -”和“$5,269”。我一直在尝试遍历 HTML 树,但无法获取标签之间的文本。
【问题讨论】:
-
可以添加你的python代码
-
请附上您尝试过的代码
标签: python html beautifulsoup