【发布时间】:2016-08-19 00:29:47
【问题描述】:
对于我发布的许多问题,我很抱歉,但我不知道如何处理这个错误:在测试这个 page 时,使用简单的 ps
ab=soup.find("article", {"itemprop":"articleBody"})
p=ab.findAll("p")
print(len(p)) #gives 1
有很多p 标签,但我只得到第一个。
我尝试将整个<article itemprop="articleBody"> html 文本复制粘贴到一个字符串中,并将其传递给一个新的BeautifulSoup 对象。在该对象中搜索 p 会给出所有所需的标签 (14)。
为什么通常的方法不起作用? p 标签是否在此处动态加载(但 html 代码看起来很正常)?
【问题讨论】:
标签: python web-scraping beautifulsoup