【发布时间】:2022-11-10 21:56:59
【问题描述】:
我正在寻找一种方法来仅提取其中没有其他标签的标签
例如:
from bs4 import BeautifulSoup
html = """
<p><a href='XYZ'>Text1</a></p>
<p>Text2</p>
<p><a href='QWERTY'>Text3</a></p>
<p>Text4</p>
"""
soup = BeautifulSoup(html, 'html.parser')
soup.find_all('p')
给
[<p><a href="XYZ">Text1</a></p>,
<p>Text2</p>,
<p><a href="QWERTY">Text3</a></p>,
<p>Text4</p>]
这就是我想要实现的目标:
[<p>Text2</p>,
<p>Text4</p>]
【问题讨论】:
标签: python web-scraping beautifulsoup