【发布时间】:2018-08-01 18:34:02
【问题描述】:
我正在学习 python 和 lib beatifulsoup 来做一些爬虫,我想从 html 代码中提取文本,但文本不在标签中。看代码
我的 bs4 代码是这样的:
for p in soup.find_all("div", class_="description__container-text"):
v1 = p
for x in v1:
print(v1)
输出如下:
<div class="description__container-text" itemprop="description">
<h2 class="description__product-title">
TEXTTEXTTEXTTEXTTEXTTEXTTEXTTEXTTEXTTEXTTEXT” HD
</h2>
<p class="description__text"></p>
*********I WANT TO EXTRACT THIS TEXT HEAR!!!!!!***************************************************
<p class="description__text"></p>
<p class="description__text">
<center>
<iframe frameborder="0" height="6500" src="https://myurl.html" width="100%"></iframe>
</center>
那么,我怎样才能得到文本:
*********I WANT TO EXTRACT THIS TEXT HEAR!!!!!!***************************************************
【问题讨论】:
标签: python beautifulsoup