【问题标题】:Beautifulsoup Scraping Object SelectionBeautifulsoup 抓取对象选择
【发布时间】:2021-01-12 14:07:30
【问题描述】:

我正在尝试通过 Beautifulsoup 进行抓取,对此我很陌生,我需要表格行,如您所见 enter image description here。 这些表格来自 reactapp,然后显示在网站上。我需要建议如何做到这一点。我正在努力创建beautifulsoup 对象,但不知道要获取表行及其内容的实际类。

webpage = urlopen(req).read()
soup = bs(webpage, "html.parser")
table=soup.find('table', {'class': 'equity'})
rows=list()
for row in table.findAll("tr"):
     rows.append(row)

需要您的帮助,非常感谢,很难完成!

【问题讨论】:

    标签: beautifulsoup


    【解决方案1】:

    您可以使用以下代码获取td 元素:

    webpage = urlopen(req).read()
    soup = bs(webpage, "lxml")
    table=soup.find('table', {'class': 'table'}).find('tr')
    rows=list()
    for row in table.findAll("td"):
         rows.append(row)
    

    我更喜欢使用lxml 作为解析器,因为它有一些优势,但您可以继续使用html.parser

    您也可以使用pandas,它会创建,从它的文档中学习要容易得多(有很多)。

    【讨论】:

      猜你喜欢
      • 2022-10-22
      • 1970-01-01
      • 2016-06-28
      • 2016-05-06
      • 1970-01-01
      • 2015-08-21
      • 1970-01-01
      • 1970-01-01
      • 2017-12-06
      相关资源
      最近更新 更多