【问题标题】:Find all returning empty list查找所有返回的空列表
【发布时间】:2019-12-03 05:00:03
【问题描述】:

我正在使用下面的代码从下面的 HTML 中提取。不知道我做错了什么,但代码返回一个空列表。我正在尝试提取“Red Hat”文本。

page = BeautifulSoup(browser.page_source, 'lxml')
page_names = page.find_all('span', class_='keyword')

HTML:

<span class="keyword">Red Hat</span>

【问题讨论】:

  • 这不可能是你正在使用的代码,因为除了关键字之外使用“类”是语法错误。
  • 打字时有些漏掉了下划线。编辑代码以与我一直在运行的内容保持一致。
  • 使用page.select_one('.keyword').text

标签: python python-2.7 list beautifulsoup


【解决方案1】:

要提取文本,我们需要使用 .getText() 试试下面的代码应该可以工作

page = BeautifulSoup(browser.page_source, 'lxml')
for x in page.find_all('span', class_='keyword'):
    print(x.getText())

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2014-08-03
    • 1970-01-01
    • 2020-08-26
    • 1970-01-01
    • 1970-01-01
    • 2012-08-18
    • 2017-06-03
    • 1970-01-01
    相关资源
    最近更新 更多