【问题标题】:How do I get all text from within this tag?如何从此标签中获取所有文本?
【发布时间】:2016-05-20 00:59:59
【问题描述】:

我正在尝试从这个 HTML 标记中获取所有文本,我将其存储在变量 tag 中:

<td rowspan="2" style="text-align: center;"><a href="/wiki/Glenn_Miller" title="Glenn Miller">Glenn Miller</a> &amp; His Orchestra</td>

结果应该是"Glenn Miller &amp; His Orchestra"

但是printing tag.find(text=True) 返回这个:"Glenn Miller"

如何获取td 元素中的其余文本?

【问题讨论】:

    标签: python html beautifulsoup html-parsing


    【解决方案1】:

    tag.find(text=True) 将返回第一个匹配的文本节点。请改用.get_text()

    >>> from bs4 import BeautifulSoup
    >>> data = '<td rowspan="2" style="text-align: center;"><a href="/wiki/Glenn_Miller" title="Glenn Miller">Glenn Miller</a> &amp; His Orchestra</td>'
    >>> soup = BeautifulSoup(data, "html.parser")
    >>> tag = soup.td
    >>> tag.get_text()
    'Glenn Miller & His Orchestra'
    

    【讨论】:

      猜你喜欢
      • 2019-07-20
      • 2015-10-06
      • 2019-01-22
      • 2020-07-29
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多