【问题标题】:get value after html taghtml标签后获取值
【发布时间】:2018-08-08 11:31:58
【问题描述】:

我正在使用 python 和 beautifulsoup 模块,又名 bs4。我正在抓取的页面格式如下:

<div class="Halls_spec">
   <b>Hall1</b> Thurs.-Wedn.: 21.30

我正在使用以下代码获取信息:

movie_date = table.select_one("div.Halls_spec")  
movieDate=(movie_date.text.strip())

我得到以下字符串:Hall1 Thurs.-Wedn. 21.30

我应该如何分别获取大厅名称和日期值?

【问题讨论】:

    标签: python web-scraping beautifulsoup


    【解决方案1】:

    您可以使用 b 标签和 next_sibling 来提取日期。

    movie_date = table.select_one("div.Halls_spec")
    movie_date.b.text.strip()
    # 'Hall1'
    movie_date.b.next_sibling
    # ' Thurs.-Wedn.: 21.30'
    

    或者您可以使用 next_elements 来获取可以迭代的生成器对象:

    for val in movie_date.b.next_elements:
         print(val)
    
    # Hall1
    #  Thurs.-Wedn.: 21.30
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2013-09-10
      • 2018-03-16
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多